Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-Flash vs Z.ai: GLM 5.1

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-04-07

Metriek Qwen3.5-Flash Qwen3.5-Flash medium Releasedatum: 2026-02-24 GLM 5.1 GLM 5.1 medium Releasedatum: 2026-04-07
Score 8.0 8.0
Rang #24 #23
Consistentie 7.6 9.0
Correcte tests
Slaagpercentage per poging 82.4% 76.5%
Instabiele tests 5 2
Totaal runs 51 51
Kosten per resultaat 0.688 1.270
Totale kosten $0.076 $0.153
Invoerprijs $0.065 / 1M $1.000 / 1M
Uitvoerprijs $0.260 / 1M $3.200 / 1M
Uitvoer-tokens 1,827 6,666
Redeneer-tokens 179,299 35,313
Responstijd (gem.) 67.96s 18.23s
Responstijd (max) 234.29s 43.11s
Responstijd (totaal) 1155.28s 291.73s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 10.0 10.0 100.0% 0 59.11s 383 32,992
GLM 5.1 10.0 10.0 100.0% 0 8.31s 401 5,122
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 10.0 10.0 100.0% 0 17.78s 483 8,270
GLM 5.1 9.5 10.0 100.0% 0 43.11s 327 4,206
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 7.3 5.9 83.3% 1 56.99s 235 16,237
GLM 5.1 10.0 10.0 100.0% 0 9.33s 991 4,552
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 5.3 7.2 44.4% 1 146.50s 58 43,615
GLM 5.1 5.3 10.0 33.3% 0 29.77s 969 11,314
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 6.1 3.1 66.7% 1 40.05s 99 38,486
GLM 5.1 10.0 10.0 100.0% 0 20.95s 2,875 2,875
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 10.0 10.0 100.0% 0 63.49s 98 14,139
GLM 5.1 6.4 5.8 66.7% 1 7.47s 204 1,617
Puzzle Solving Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 6.4 4.4 77.8% 2 56.74s 162 24,276
GLM 5.1 8.2 7.2 88.9% 1 23.85s 899 5,627
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5-Flash 10.0 10.0 100.0% 0 10.33s 309 1,284
GLM 5.1 3.0 10.0 0.0% 0 0ms 0 0

Snelle vergelijking

Vergelijkingspaar wisselen