Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs Z.ai: GLM 5V Turbo

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-01

Metriek DeepSeek V3.2 DeepSeek V3.2 medium Releasedatum: 2025-12-01 GLM 5V Turbo GLM 5V Turbo medium Releasedatum: 2026-04-01
Score 8.0 7.8
Rang #38 #44
Betrouwbaarheid n.v.t. n.v.t.
Consistentie 8.2 7.5
Correcte tests
Slaagpercentage per poging 79.6% 77.8%
Instabiele tests 4 6
Totaal runs 52 54
Kosten per resultaat 0.231 2.643
Totale kosten $0.028 $0.291
Invoerprijs $0.252 / 1M $1.200 / 1M
Uitvoerprijs $0.378 / 1M $4.000 / 1M
Uitvoer-tokens 7,554 2,351
Redeneer-tokens 45,588 58,941
Responstijd (gem.) 43.49s 14.96s
Responstijd (max) 180.92s 67.08s
Responstijd (totaal) 782.73s 269.32s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 8.4 9.9 75.0% 0 30.72s 3,773 7,523
GLM 5V Turbo 7.2 6.1 75.0% 2 10.76s 587 7,872
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 4.7 1.6 66.7% 1 180.92s 626 6,792
GLM 5V Turbo 10.0 10.0 100.0% 0 13.78s 404 4,628
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 10.0 10.0 100.0% 0 93.11s 571 6,296
GLM 5V Turbo 6.9 3.8 66.7% 1 15.06s 403 2,523
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 10.0 10.0 100.0% 0 36.09s 207 7,693
GLM 5V Turbo 10.0 10.0 100.0% 0 9.60s 236 4,333
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 5.3 7.2 44.4% 1 21.78s 15 4,933
GLM 5V Turbo 5.3 7.2 44.4% 1 38.15s 32 29,035
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 5.4 2.5 66.7% 1 31.30s 68 2,366
GLM 5V Turbo 10.0 10.0 100.0% 0 11.09s 131 2,183
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 10.0 10.0 100.0% 0 35.78s 1,397 2,845
GLM 5V Turbo 9.9 10.0 100.0% 0 3.74s 72 1,813
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 8.2 7.2 88.9% 1 36.87s 390 6,281
GLM 5V Turbo 7.7 7.3 77.8% 1 10.91s 193 5,789
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
DeepSeek V3.2 10.0 10.0 100.0% 0 34.81s 507 859
GLM 5V Turbo 7.0 3.7 66.7% 1 12.53s 293 765

Snelle vergelijking

Vergelijkingspaar wisselen