Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-27B vs Z.ai: GLM 5

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-02

Metriek Qwen3.5-27B Qwen3.5-27B medium Releasedatum: 2026-02-24 GLM 5 GLM 5 medium Releasedatum: 2026-02-12
Score 7.9 8.2
Rang #27 #19
Betrouwbaarheid 10.0 10.0
Consistentie 8.9 8.4
Correcte tests
Slaagpercentage per poging 73.3% 81.7%
Instabiele tests 3 4
Totaal runs 60 60
Kosten per resultaat 4.532 1.676
Totale kosten $0.488 $0.228
Invoerprijs $0.195 / 1M $0.600 / 1M
Uitvoerprijs $1.560 / 1M $2.080 / 1M
Totaal aantal invoer-tokens 39,329 32,626
Uitvoer-tokens 2,569 21,558
Redeneer-tokens 304,894 95,772
Responstijd (gem.) 60.09s 32.67s
Responstijd (max) 177.36s 99.85s
Responstijd (totaal) 1201.89s 392.01s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.5-27B 8.7 7.9 91.7% 1 19.75s 672 569 31,505
GLM 5 10.0 10.0 100.0% 0 23.66s 555 480 7,056
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.5-27B 7.0 9.8 50.0% 0 123.86s 5,060 416 64,993
GLM 5 10.0 10.0 100.0% 0 89.47s 4,656 2,985 45,706
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.5-27B 10.0 10.0 100.0% 0 163.96s 14,946 483 9,991
GLM 5 10.0 10.0 100.0% 0 28.96s 12,804 662 3,242
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.5-27B 10.0 10.0 100.0% 0 30.26s 7,782 270 16,150
GLM 5 7.1 5.6 83.3% 1 8.90s 5,508 567 3,734
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.5-27B 5.3 10.0 33.3% 0 79.53s 553 43 52,368
GLM 5 3.5 4.4 33.3% 2 0ms 260 13,176 14,137
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.5-27B 6.1 3.1 66.7% 1 101.41s 524 70 23,147
GLM 5 6.1 3.1 66.7% 1 14.69s 477 2,020 2,248
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.5-27B 10.0 10.0 100.0% 0 19.66s 699 97 11,638
GLM 5 10.0 10.0 100.0% 0 7.25s 636 1,001 2,129
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.5-27B 8.2 7.7 77.8% 1 59.60s 696 242 70,096
GLM 5 10.0 10.0 100.0% 0 11.33s 609 33 4,076
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.5-27B 10.0 10.0 100.0% 0 7.45s 8,193 348 1,323
GLM 5 10.0 10.0 100.0% 0 15.93s 6,935 233 994
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Qwen3.5-27B 3.0 10.0 0.0% 0 85.11s 204 31 23,683
GLM 5 3.0 10.0 0.0% 0 67.37s 186 401 12,450

Snelle vergelijking

Vergelijkingspaar wisselen