Navigare
Advertise here

Qwen3.7 Flash (low) vs Grok 4.5 (medium)

Grok 4.5 (medium) conduce la scorul mediu cu 7.8 vs 7.7. Qwen3.7 Flash (low) are costul de benchmark mai mic, $0.071 vs $2.996. Qwen3.7 Flash (low) este mai rapid cu 41.03s vs 68.44s, cu rate de reușită de 68.1% vs 79.7%.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-10-05

Modele comparate

Rang
#117
Total tokenuri de ieșire
331,107
Timp de răspuns (mediu)
41.03s
Cost total
$0.071
Rang
#107
Total tokenuri de ieșire
306,044
Timp de răspuns (mediu)
68.44s
Cost total
$2.996
Model recomandat Qwen3.7 Flash (low)

Scorul rămâne aproape de cel mai bun scor de aici (7.7 vs 7.8) și costă de aproximativ 42.6x mai puțin decât Grok 4.5 (medium).

Comparație detaliată

Metrică Qwen3.7 Flash Qwen3.7 Flash low Lansare: 2026-07-28 Grok 4.5 Grok 4.5 medium Lansare: 2026-07-08
Scor 7.7 7.8
Rang #117 #107
Fiabilitate 10.0 10.0
Consistență 8.1 9.0
Încercări 69/69 69/69
Teste corecte
Rată de trecere pe încercare 68.1% 79.7%
Teste instabile 6 3
Rulări totale 69 69
Cost per rezultat 0.439 14.430
Cost total $0.071 $2.996
Preț de intrare $0.030 / 1M $2.000 / 1M
Preț de ieșire $0.130 / 1M $6.000 / 1M
Preț citire cache $0.006 / 1M $0.300 / 1M
Preț scriere cache $0.039 / 1M N/D
Total tokenuri de intrare 318,058 308,369
Tokenuri de ieșire 16,035 7,013
Tokenuri de raționament 315,072 299,031
Timp de răspuns (mediu) 41.03s 68.44s
Timp de răspuns (maxim) 394.54s 436.38s
Timp de răspuns (total) 943.75s 1574.14s
Parametri ~35B în total (~3B activi) ~1.7T în total (~170B activi)
Disponibilitate Închis Închis

Prețurile de cache se aplică tokenurilor de intrare. Citirea reutilizează prompturi salvate; scrierea le stochează și poate costa în plus. Tokenurile de ieșire folosesc prețul de ieșire.

Prezentare generare modele

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#117 Qwen3.7 Flash

low
Reached the allocated time limit (600 seconds) without receiving showcase output.
Cost
$0.000
Timp
600.0s
Tokenuri
0 tok

#107 SpaceXAI: Grok 4.5

medium
Cost
$0.044
Timp
59.4s
Tokenuri
7,512 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Programare Scor Consistență Rată de trecere pe încercare Teste instabile Teste corecte Timp de răspuns (mediu) Tokenuri de intrare Tokenuri de ieșire Tokenuri de raționament
Qwen3.7 Flash 6.7 7.8 55.6% 1 42.36s 7,893 428 56,419
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

Comparație rapidă

Schimbă perechea de comparație