Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs MoonshotAI: Kimi K2.6

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-06-04

Metriek Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low Releasedatum: 2026-03-03 Kimi K2.6 Kimi K2.6 medium Releasedatum: 2026-04-20 Gratis beschikbaar
Score 7.4 7.2
Rang #50 #60
Betrouwbaarheid 10.0 10.0
Consistentie 10.0 8.6
Correcte tests
Slaagpercentage per poging 61.9% 65.1%
Instabiele tests 0 3
Totaal runs 63 63
Kosten per resultaat 0.196 8.358
Totale kosten $0.026 $0.891
Invoerprijs $0.250 / 1M $0.684 / 1M
Uitvoerprijs $1.500 / 1M $3.420 / 1M
Totaal aantal invoer-tokens 32,715 29,450
Uitvoer-tokens 2,286 102,923
Redeneer-tokens 9,166 254,094
Responstijd (gem.) 2.77s 71.67s
Responstijd (max) 11.91s 406.78s
Responstijd (totaal) 58.12s 1433.36s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 8.3 10.0 75.0% 0 2.12s 506 462 1,638
Kimi K2.6 7.0 8.0 66.7% 1 11.59s 618 7,115 8,934
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 1.39s 8,138 660 1,060
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 11.91s 8,381 225 762
Kimi K2.6 10.0 10.0 100.0% 0 40.96s 11,271 711 13,876
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.00s 7,455 291 696
Kimi K2.6 10.0 10.0 100.0% 0 20.38s 7,014 316 11,305
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 2.36s 641 18 1,212
Kimi K2.6 5.3 7.2 44.4% 1 202.38s 326 47,035 98,262
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 1.54s 490 69 384
Kimi K2.6 10.0 10.0 100.0% 0 17.83s 477 3,981 4,472
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.49s 621 72 753
Kimi K2.6 10.0 10.0 100.0% 0 12.53s 669 3,977 5,269
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.69s 566 243 1,248
Kimi K2.6 6.0 7.4 55.6% 1 25.06s 651 13,860 17,599
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 9.54s 5,757 237 993
Kimi K2.6 10.0 10.0 100.0% 0 8.92s 5,286 248 1,011
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 1.35s 160 9 420
Kimi K2.6 3.0 10.0 0.0% 0 130.27s 213 15,710 16,177

Snelle vergelijking

Vergelijkingspaar wisselen