Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get ๐Ÿ“Šstats, ๐Ÿ”ฅheatmaps and ๐Ÿ‘€recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Vergeleken modellen

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-10

Metriek Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Releasedatum: 2026-02-15 Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium Releasedatum: 2026-04-20 Gratis beschikbaar GLM 5 Turbo GLM 5 Turbo medium Releasedatum: 2026-03-15
Score 8.2 8.2 8.1
Rang #12 #15 #20
Betrouwbaarheid 10.0 n.v.t. 6.7
Consistentie 9.1 10.0 8.4
Correcte tests
Slaagpercentage per poging 79.0% 75.0% 77.2%
Instabiele tests 2 0 4
Totaal runs 57 57 57
Kosten per resultaat 1.758 0.000 1.438
Totale kosten $0.247 $0.000 $0.187
Invoerprijs $0.260 / 1M $0.000 / 1M $1.200 / 1M
Uitvoerprijs $1.560 / 1M $0.000 / 1M $4.000 / 1M
Uitvoer-tokens 2,145 1,153 12,217
Redeneer-tokens 129,019 62,197 40,252
Responstijd (gem.) 51.33s 15.25s 18.85s
Responstijd (max) 120.91s 43.55s 194.23s
Responstijd (totaal) 616.01s 182.96s 358.15s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-02-15 8.2 7.9 83.3% 1 45.78s 205 21,236
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 11.69s 61 5,812
GLM 5 Turbo 10.0 10.0 100.0% 0 4.82s 362 3,137
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 120.91s 367 19,367
Qwen3.6 Plus Preview 0.0 0.0 0.0% 0 0ms 0 0
GLM 5 Turbo 10.0 10.0 100.0% 0 12.26s 332 3,301
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 46.85s 421 7,906
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 34.95s 452 13,073
GLM 5 Turbo 10.0 10.0 100.0% 0 13.88s 390 2,037
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 46.91s 270 14,916
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 14.95s 270 10,706
GLM 5 Turbo 10.0 10.0 100.0% 0 6.19s 577 3,632
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-02-15 5.3 10.0 33.3% 0 17.50s 35 16,680
Qwen3.6 Plus Preview 3.0 10.0 0.0% 0 22.08s 49 26,895
GLM 5 Turbo 2.9 4.4 22.2% 2 71.07s 9,665 19,279
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-02-15 4.7 1.6 66.7% 1 79.86s 73 8,675
Qwen3.6 Plus Preview 0.0 0.0 0.0% 0 0ms 0 0
GLM 5 Turbo 6.1 3.1 66.7% 1 10.05s 60 2,216
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 31.93s 101 7,704
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 3.40s 27 1,383
GLM 5 Turbo 10.0 10.0 100.0% 0 5.38s 255 2,183
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 34.57s 340 14,496
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 7.52s 27 2,998
GLM 5 Turbo 8.7 7.9 77.8% 1 5.44s 315 2,702
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 7.54s 309 909
Qwen3.6 Plus Preview 10.0 10.0 100.0% 0 5.87s 267 1,330
GLM 5 Turbo 10.0 10.0 100.0% 0 9.84s 241 446
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 103.81s 24 17,130
Qwen3.6 Plus Preview 0.0 0.0 0.0% 0 0ms 0 0
GLM 5 Turbo 3.0 10.0 0.0% 0 40.17s 20 1,319

Snelle vergelijking

Vergelijkingspaar wisselen