Navigatie
AI BENCHY
Your ad here

AI BENCHY Compare

Qwen: Qwen3.5-9B vs Z.ai: GLM 4.7 Flash

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-26

Metriek Qwen3.5-9B Qwen3.5-9B medium Releasedatum: 2026-03-02 GLM 4.7 Flash GLM 4.7 Flash medium Releasedatum: 2026-01-19
Score 4.4 4.6
Rang #114 #109
Betrouwbaarheid n.v.t. n.v.t.
Consistentie 7.2 6.3
Correcte tests
Slaagpercentage per poging 33.3% 38.9%
Instabiele tests 6 8
Totaal runs 54 54
Kosten per resultaat 0.976 1.126
Totale kosten $0.030 $0.046
Invoerprijs $0.100 / 1M $0.060 / 1M
Uitvoerprijs $0.150 / 1M $0.400 / 1M
Uitvoer-tokens 24,291 39,688
Redeneer-tokens 172,597 72,401
Responstijd (gem.) 73.64s 32.33s
Responstijd (max) 226.38s 174.55s
Responstijd (totaal) 1104.60s 355.65s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-9B 5.1 5.8 50.0% 2 34.44s 2,621 12,411
GLM 4.7 Flash 4.7 5.9 41.7% 2 14.95s 1,122 6,110
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-9B 2.6 10.0 0.0% 0 135.61s 6,150 31,393
GLM 4.7 Flash 3.6 2.1 33.3% 1 21.26s 969 6,936
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-9B 3.0 10.0 0.0% 0 0ms 0 0
GLM 4.7 Flash 2.8 2.1 33.3% 1 65.57s 2,585 20,648
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-9B 3.6 5.6 33.3% 1 87.31s 1,383 32,113
GLM 4.7 Flash 6.3 10.0 50.0% 0 1.51s 584 2,755
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-9B 3.6 7.2 22.2% 1 137.75s 11,549 48,475
GLM 4.7 Flash 3.5 4.4 33.3% 2 174.55s 33,000 25,394
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-9B 2.8 1.6 33.3% 1 226.38s 0 30,695
GLM 4.7 Flash 3.6 9.7 0.0% 0 18.14s 18 2,138
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-9B 6.4 5.8 66.7% 1 17.15s 599 4,517
GLM 4.7 Flash 6.2 5.8 66.7% 1 2.97s 388 2,181
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-9B 3.1 10.0 0.0% 0 33.38s 1,545 11,844
GLM 4.7 Flash 2.9 7.2 11.1% 1 12.90s 798 5,225
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-9B 10.0 10.0 100.0% 0 4.31s 444 1,149
GLM 4.7 Flash 10.0 10.0 100.0% 0 15.95s 224 1,014

Snelle vergelijking

Vergelijkingspaar wisselen