Navigatie
Advertise here

Qwen3.7 Plus (medium) vs GLM 5.2 (high)

GLM 5.2 (high) leidt in gemiddelde score met 8.4 vs 8.3. Qwen3.7 Plus (medium) heeft lagere benchmarkkosten met $0.415 vs $4.632. Qwen3.7 Plus (medium) is sneller met 59.73s vs 69.11s, met slagingspercentages van 76.8% vs 71.0%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-09

Vergeleken modellen

Rang
#86
Totaal aantal uitvoer-tokens
215,560
Responstijd (gem.)
59.73s
Totale kosten
$0.415
Rang
#78
Totaal aantal uitvoer-tokens
382,333
Responstijd (gem.)
69.11s
Totale kosten
$4.632
Aanbevolen model Qwen3.7 Plus (medium)

De score blijft dicht bij de beste score hier (8.3 vs 8.4) en het kost ongeveer 11.2x minder dan GLM 5.2 (high).

Gedetailleerde vergelijking

Metriek Qwen3.7 Plus Qwen3.7 Plus medium Releasedatum: 2026-06-03 GLM 5.2 GLM 5.2 high Releasedatum: 2026-06-17
Score 8.3 8.4
Rang #86 #78
Betrouwbaarheid 10.0 10.0
Consistentie 8.9 8.6
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 76.8% 71.0%
Instabiele tests 3 3
Totaal runs 69 69
Kosten per resultaat 2.697 7.314
Totale kosten $0.415 $4.632
Invoerprijs $0.320 / 1M $0.153 / 1M
Uitvoerprijs $1.280 / 1M $12.000 / 1M
Prijs voor cachelezen $0.064 / 1M $0.150 / 1M
Prijs voor cacheschrijven $0.400 / 1M n.v.t.
Totaal aantal invoer-tokens 350,546 288,913
Uitvoer-tokens 8,576 79,462
Redeneer-tokens 206,984 303,120
Responstijd (gem.) 59.73s 69.11s
Responstijd (max) 315.30s 599.43s
Responstijd (totaal) 1373.73s 1589.43s
Parameters ~397B totaal (~17B actief) 744B totaal (40B actief)
Beschikbaarheid Gesloten broncode Open-source

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#86 Qwen3.7 Plus

medium
Kosten
$0.018
Tijd
193.2s
Tokens
10,821 tok

#78 GLM 5.2

high
Reached the allocated time limit (300 seconds) without receiving showcase output.
Kosten
$0.000
Tijd
300.0s
Tokens
0 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

Vergelijkingspaar wisselen