Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 2.5 Flash vs Z.ai: GLM 5 Turbo

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-01

Metriek Gemini 2.5 Flash Gemini 2.5 Flash medium Releasedatum: 2025-06-17 GLM 5 Turbo GLM 5 Turbo medium Releasedatum: 2026-03-15
Score 8.2 8.1
Rang #21 #25
Betrouwbaarheid n.v.t. n.v.t.
Consistentie 9.5 8.0
Correcte tests
Slaagpercentage per poging 75.9% 77.8%
Instabiele tests 1 5
Totaal runs 54 54
Kosten per resultaat 2.454 1.511
Totale kosten $0.319 $0.182
Invoerprijs $0.300 / 1M $1.200 / 1M
Uitvoerprijs $2.500 / 1M $4.000 / 1M
Uitvoer-tokens 1,898 12,197
Redeneer-tokens 122,273 38,933
Responstijd (gem.) 12.12s 17.67s
Responstijd (max) 95.48s 194.23s
Responstijd (totaal) 218.12s 317.98s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 8.4 10.0 75.0% 0 6.30s 255 10,233
GLM 5 Turbo 10.0 10.0 100.0% 0 4.82s 362 3,137
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 10.0 10.0 100.0% 0 16.23s 522 10,350
GLM 5 Turbo 10.0 10.0 100.0% 0 12.26s 332 3,301
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 10.0 10.0 100.0% 0 28.44s 303 11,922
GLM 5 Turbo 10.0 10.0 100.0% 0 13.88s 390 2,037
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 10.0 10.0 100.0% 0 4.06s 279 2,325
GLM 5 Turbo 10.0 10.0 100.0% 0 6.19s 577 3,632
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 5.9 7.2 55.6% 1 37.34s 18 80,702
GLM 5 Turbo 2.9 4.4 22.2% 2 71.07s 9,665 19,279
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 4.8 10.0 0.0% 0 4.86s 92 1,899
GLM 5 Turbo 6.1 3.1 66.7% 1 10.05s 60 2,216
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 9.8 10.0 100.0% 0 2.62s 69 1,203
GLM 5 Turbo 10.0 10.0 100.0% 0 5.38s 255 2,183
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 7.7 10.0 66.7% 0 3.94s 126 2,499
GLM 5 Turbo 7.3 5.8 55.6% 2 5.44s 315 2,702
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 2.5 Flash 10.0 10.0 100.0% 0 6.20s 234 1,140
GLM 5 Turbo 10.0 10.0 100.0% 0 9.84s 241 446

Snelle vergelijking

Vergelijkingspaar wisselen