Navigatie
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs Xiaomi: MiMo-V2.5

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-05-19

Metriek Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Releasedatum: 2026-05-08 MiMo-V2.5 MiMo-V2.5 medium Releasedatum: 2026-04-22
Score 7.6 7.8
Rang #49 #37
Betrouwbaarheid 10.0 10.0
Consistentie 9.2 8.6
Correcte tests
Slaagpercentage per poging 68.4% 75.9%
Instabiele tests 2 3
Totaal runs 57 54
Kosten per resultaat 0.203 2.101
Totale kosten $0.025 $0.253
Invoerprijs $0.250 / 1M $0.400 / 1M
Uitvoerprijs $1.500 / 1M $2.000 / 1M
Uitvoer-tokens 2,702 2,821
Redeneer-tokens 8,596 116,207
Responstijd (gem.) 1.92s 14.40s
Responstijd (max) 5.66s 86.93s
Responstijd (totaal) 36.49s 259.20s

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Anti-AI-trucs Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite 7.3 6.2 75.0% 2 1.84s 1,013 1,548
MiMo-V2.5 10.0 10.0 100.0% 0 4.14s 281 1,739
Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.46s 441 408
MiMo-V2.5 10.0 10.0 100.0% 0 31.48s 488 14,813
Gecombineerd Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 4.48s 348 975
MiMo-V2.5 10.0 10.0 100.0% 0 16.86s 363 7,609
Gegevensparsering en extractie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.44s 291 697
MiMo-V2.5 2.7 5.7 16.7% 1 6.33s 306 5,714
Domeinspecifiek Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite 5.3 10.0 33.3% 0 1.52s 15 1,214
MiMo-V2.5 5.3 10.0 33.3% 0 34.53s 507 49,478
Algemene intelligentie Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 1.37s 69 438
MiMo-V2.5 5.4 2.5 66.7% 1 5.37s 121 418
Instructies opvolgen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.52s 72 760
MiMo-V2.5 9.9 10.0 100.0% 0 1.80s 88 801
Puzzeloplossing Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.40s 210 1,191
MiMo-V2.5 8.2 7.2 88.9% 1 20.60s 364 33,211
Toolaanroepen Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 5.66s 234 945
MiMo-V2.5 10.0 10.0 100.0% 0 7.29s 303 2,424
Algemene kennis Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Uitvoer-tokens Redeneer-tokens
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 1.46s 9 420
MiMo-V2.5 - - - - - - - -

Snelle vergelijking

Vergelijkingspaar wisselen