Navigatie
AI BENCHY
Advertise here

Qwen: Qwen3.6 Max Preview vs Z.ai: GLM 5.2

Qwen3.6 Max Preview (medium) leidt in gemiddelde score met 8.4 vs 8.0. GLM 5.2 (high) heeft lagere benchmarkkosten met $0.296 vs $1.143. GLM 5.2 (high) is sneller met 62.65s vs 67.53s, met slagingspercentages van 80.3% vs 71.2%.

Aanbevolen modelGLM 5.2 (high)De score blijft dicht bij de beste score hier (8.0 vs 8.4) en het kost ongeveer 3.9x minder dan Qwen3.6 Max Preview (medium).

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-07-18

Metriek Qwen3.6 Max Preview Qwen3.6 Max Preview medium Releasedatum: 2026-04-20 GLM 5.2 GLM 5.2 high Releasedatum: 2026-06-17
Score 8.4 8.0
Rang #19 #31
Betrouwbaarheid 9.9 10.0
Consistentie 8.9 8.6
Correcte tests
Slaagpercentage per poging 80.3% 71.2%
Instabiele tests 3 3
Totaal runs 66 66
Kosten per resultaat 8.173 5.873
Totale kosten $1.143 $0.296
Invoerprijs $1.040 / 1M $0.293 / 1M
Uitvoerprijs $6.240 / 1M $0.920 / 1M
Totaal aantal invoer-tokens 79,240 83,813
Uitvoer-tokens 5,098 69,688
Redeneer-tokens 164,842 225,659
Responstijd (gem.) 67.53s 62.65s
Responstijd (max) 238.07s 599.43s
Responstijd (totaal) 1485.64s 1378.34s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#19 Qwen3.6 Max Preview

medium
Kosten
$0.024
Tijd
76.5s
Tokens
3,861 tok

#31 GLM 5.2

high
Ongeldige SVG
Kosten
$0.000
Tijd
300.0s
Tokens
0 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

Snelle vergelijking

Vergelijkingspaar wisselen