Navigare
AI BENCHY
Advertise here

GPT-5.6 Luna (low) vs MiMo-V2.5 (medium)

MiMo-V2.5 (medium) conduce la scorul mediu cu 6.4 vs 6.2. GPT-5.6 Luna (low) are costul de benchmark mai mic, $0.051 vs $0.104. GPT-5.6 Luna (low) este mai rapid cu 5.20s vs 46.28s, cu rate de reușită de 54.5% vs 68.2%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-08-20

Rang
#167
Total tokenuri de ieșire
26,286
Timp de răspuns (mediu)
5.20s
Cost total
$0.051
Rang
#160
Total tokenuri de ieșire
327,048
Timp de răspuns (mediu)
46.28s
Cost total
$0.104
Model recomandat GPT-5.6 Luna (low)

Scorul rămâne aproape de cel mai bun scor de aici (6.2 vs 6.4) și costă de aproximativ 2.0x mai puțin decât MiMo-V2.5 (medium).

Comparație detaliată

Metrică GPT-5.6 Luna GPT-5.6 Luna low Lansare: 2026-07-09 MiMo-V2.5 MiMo-V2.5 medium Lansare: 2026-04-22
Scor 6.2 6.4
Rang #167 #160
Fiabilitate 10.0 10.0
Consistență 8.2 7.5
Încercări 66/66 66/66
Teste corecte
Rată de trecere pe încercare 54.5% 68.2%
Teste instabile 5 7
Rulări totale 66 66
Cost per rezultat 2.437 3.575
Cost total $0.051 $0.104
Preț de intrare $0.200 / 1M $0.140 / 1M
Preț de ieșire $1.200 / 1M $0.280 / 1M
Total tokenuri de intrare 96,355 105,456
Tokenuri de ieșire 8,213 7,108
Tokenuri de raționament 18,073 319,940
Timp de răspuns (mediu) 5.20s 46.28s
Timp de răspuns (maxim) 19.44s 316.27s
Timp de răspuns (total) 114.46s 1018.12s
Parametri ~400B în total (~17B activi) 310B în total (15B activi)
Disponibilitate Închis Sursă deschisă

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 GPT-5.6 Luna

low
Cost
$0.011
Timp
10.2s
Tokenuri
1,897 tok

#160 MiMo-V2.5

medium
Cost
$0.002
Timp
54.8s
Tokenuri
5,247 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

Comparație rapidă

Schimbă perechea de comparație