Navigare
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Ling-2.6-flash vs GPT-5.4 Nano

Ling-2.6-flash conduce la scorul mediu cu 4.9 vs 4.8. Ling-2.6-flash are costul de benchmark mai mic, $0.002 vs $0.041. GPT-5.4 Nano este mai rapid cu 2.56s vs 10.71s, cu rate de reușită de 30.3% vs 27.3%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-09-04

Rang
#271
Total tokenuri de ieșire
14,903
Timp de răspuns (mediu)
10.71s
Cost total
$0.002
Rang
#276
Total tokenuri de ieșire
13,794
Timp de răspuns (mediu)
2.56s
Cost total
$0.041
Model recomandat GPT-5.4 Nano

Scorul rămâne aproape de cel mai bun scor de aici (4.8 vs 4.9) și răspunde de aproximativ 4.2x mai rapid decât Ling-2.6-flash.

Comparație detaliată

Metrică Ling-2.6-flash Ling-2.6-flash none Lansare: 2026-04-21 GPT-5.4 Nano GPT-5.4 Nano none Lansare: 2026-03-17
Scor 4.9 4.8
Rang #271 #276
Fiabilitate 9.6 10.0
Consistență 9.3 8.6
Încercări 66/66 66/66
Teste corecte
Rată de trecere pe încercare 30.3% 27.3%
Teste instabile 2 4
Rulări totale 66 66
Cost per rezultat 0.024 1.011
Cost total $0.002 $0.041
Preț de intrare $0.010 / 1M $0.200 / 1M
Preț de ieșire $0.030 / 1M $1.250 / 1M
Total tokenuri de intrare 114,384 115,933
Tokenuri de ieșire 14,903 13,794
Tokenuri de raționament 0 0
Timp de răspuns (mediu) 10.71s 2.56s
Timp de răspuns (maxim) 36.03s 25.50s
Timp de răspuns (total) 214.28s 56.37s
Parametri 104B în total (7.4B activi) ~120B în total (~5B activi)
Disponibilitate Sursă deschisă Închis

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#271 Ling-2.6-flash

none
Ling-2.6-flash is no longer available as a free model. It has transitioned to a paid model. Continue using it here: https://openrouter.ai/inclusionai/ling-2.6-flash
Cost
$0.000
Timp
0.0s
Tokenuri
0 tok

#276 GPT-5.4 Nano

none
Cost
$0.008
Timp
46.1s
Tokenuri
5,735 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Ling-2.6-flash 5.3 10.0 33.3% 0 11.21s 813 381 0
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0

Comparație rapidă

Schimbă perechea de comparație