Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MoonshotAI: Kimi K2.6 vs Qwen: Qwen3.5 Plus 2026-04-20

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-22

Metriek Kimi K2.6 Kimi K2.6 medium Releasedatum: 2026-04-20 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium Releasedatum: 2026-04-20
Score 7.4 7.6
Rang #54 #42
Betrouwbaarheid 8.3 9.6
Consistentie 8.3 8.7
Correcte tests
Slaagpercentage per poging 70.8% 71.7%
Instabiele tests 4 3
Totaal runs 60 60
Kosten per resultaat 7.630 2.789
Totale kosten $0.916 $0.363
Invoerprijs $0.730 / 1M $0.300 / 1M
Uitvoerprijs $3.490 / 1M $1.800 / 1M
Uitvoer-tokens 102,488 2,245
Redeneer-tokens 229,389 150,235
Responstijd (gem.) 54.11s 43.63s
Responstijd (max) 215.85s 189.38s
Responstijd (totaal) 1028.14s 872.61s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Kimi K2.6 7.0 8.0 66.7% 1 11.59s 7,115 8,934
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 10.84s 215 7,748
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Kimi K2.6 6.5 5.3 75.0% 1 118.23s 9,255 52,215
Qwen3.5 Plus 2026-04-20 5.4 6.0 66.7% 1 137.55s 287 42,318
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Kimi K2.6 10.0 10.0 100.0% 0 40.96s 711 13,876
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 92.41s 483 17,490
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Kimi K2.6 10.0 10.0 100.0% 0 20.38s 316 11,305
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 38.32s 270 14,668
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Kimi K2.6 5.3 7.2 44.4% 1 202.38s 47,035 98,262
Qwen3.5 Plus 2026-04-20 2.9 7.2 11.1% 1 53.10s 63 28,414
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Kimi K2.6 10.0 10.0 100.0% 0 17.83s 3,981 4,472
Qwen3.5 Plus 2026-04-20 4.9 9.6 0.0% 0 25.30s 125 4,792
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Kimi K2.6 10.0 10.0 100.0% 0 12.53s 3,977 5,269
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 20.25s 103 7,689
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Kimi K2.6 6.0 7.4 55.6% 1 25.59s 14,140 17,868
Qwen3.5 Plus 2026-04-20 8.2 7.2 88.9% 1 17.58s 324 9,786
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Kimi K2.6 10.0 10.0 100.0% 0 8.92s 248 1,011
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 14.72s 348 2,164
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Kimi K2.6 3.0 10.0 0.0% 0 130.27s 15,710 16,177
Qwen3.5 Plus 2026-04-20 3.0 10.0 0.0% 0 92.57s 27 15,166

Snelle vergelijking

Vergelijkingspaar wisselen