Navigare
AI BENCHY
Advertise here

Qwen3.7 Max vs MiMo-V2.5 (medium)

Qwen3.7 Max conduce la scorul mediu cu 7.4 vs 6.4. MiMo-V2.5 (medium) are costul de benchmark mai mic, $0.104 vs $0.197. Qwen3.7 Max este mai rapid cu 4.56s vs 46.28s, cu rate de reușită de 68.2% vs 68.2%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-08-20

Rang
#91
Total tokenuri de ieșire
12,446
Timp de răspuns (mediu)
4.56s
Cost total
$0.197
Rang
#160
Total tokenuri de ieșire
327,048
Timp de răspuns (mediu)
46.28s
Cost total
$0.104
Model recomandat Qwen3.7 Max

Are cel mai bun scor aici (7.4) și răspunde de aproximativ 10.2x mai rapid decât MiMo-V2.5 (medium).

Comparație detaliată

Metrică Qwen3.7 Max Qwen3.7 Max none Lansare: 2026-05-22 MiMo-V2.5 MiMo-V2.5 medium Lansare: 2026-04-22
Scor 7.4 6.4
Rang #91 #160
Fiabilitate 9.9 10.0
Consistență 10.0 7.5
Încercări 66/66 66/66
Teste corecte
Rată de trecere pe încercare 68.2% 68.2%
Teste instabile 0 7
Rulări totale 66 66
Cost per rezultat 1.581 3.575
Cost total $0.197 $0.104
Preț de intrare $1.475 / 1M $0.140 / 1M
Preț de ieșire $4.425 / 1M $0.280 / 1M
Total tokenuri de intrare 95,992 105,456
Tokenuri de ieșire 12,446 7,108
Tokenuri de raționament 0 319,940
Timp de răspuns (mediu) 4.56s 46.28s
Timp de răspuns (maxim) 72.30s 316.27s
Timp de răspuns (total) 100.30s 1018.12s
Parametri ~1T în total (~40B activi) 310B în total (15B activi)
Disponibilitate Închis Sursă deschisă

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 Qwen3.7 Max

none
Cost
$0.046
Timp
195.0s
Tokenuri
12,171 tok

#160 MiMo-V2.5

medium
Cost
$0.002
Timp
54.8s
Tokenuri
5,247 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

Comparație rapidă

Schimbă perechea de comparație