Navigatie
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.7 Flash (low) vs Grok 4.5 (low)

Grok 4.5 (low) leidt in gemiddelde score met 7.8 vs 7.7. Qwen3.7 Flash (low) heeft lagere benchmarkkosten met $0.071 vs $1.345. Grok 4.5 (low) is sneller met 18.14s vs 41.03s, met slagingspercentages van 68.1% vs 73.9%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-06

Vergeleken modellen

Rang
#117
Totaal aantal uitvoer-tokens
331,107
Responstijd (gem.)
41.03s
Totale kosten
$0.071
Rang
#112
Totaal aantal uitvoer-tokens
121,415
Responstijd (gem.)
18.14s
Totale kosten
$1.345
Aanbevolen model Qwen3.7 Flash (low)

De score blijft dicht bij de beste score hier (7.7 vs 7.8) en het kost ongeveer 19.1x minder dan Grok 4.5 (low).

Gedetailleerde vergelijking

Metriek Qwen3.7 Flash Qwen3.7 Flash low Releasedatum: 2026-07-28 Grok 4.5 Grok 4.5 low Releasedatum: 2026-07-08
Score 7.7 7.8
Rang #117 #112
Betrouwbaarheid 10.0 10.0
Consistentie 8.1 9.3
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 68.1% 73.9%
Instabiele tests 6 2
Totaal runs 69 69
Kosten per resultaat 0.439 8.404
Totale kosten $0.071 $1.345
Invoerprijs $0.030 / 1M $2.000 / 1M
Uitvoerprijs $0.130 / 1M $6.000 / 1M
Prijs voor cachelezen $0.006 / 1M $0.300 / 1M
Prijs voor cacheschrijven $0.039 / 1M n.v.t.
Totaal aantal invoer-tokens 318,058 308,068
Uitvoer-tokens 16,035 9,218
Redeneer-tokens 315,072 112,197
Responstijd (gem.) 41.03s 18.14s
Responstijd (max) 394.54s 205.28s
Responstijd (totaal) 943.75s 417.21s
Parameters ~35B totaal (~3B actief) ~1.7T totaal (~170B actief)
Beschikbaarheid Gesloten broncode Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#117 Qwen3.7 Flash

low
Reached the allocated time limit (600 seconds) without receiving showcase output.
Kosten
$0.000
Tijd
600.0s
Tokens
0 tok

#112 SpaceXAI: Grok 4.5

low
Kosten
$0.011
Tijd
12.4s
Tokens
2,018 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.7 Flash 6.7 7.8 55.6% 1 42.36s 7,893 428 56,419
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

Snelle vergelijking

Vergelijkingspaar wisselen