Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Gemini 3.1 Flash Lite (low) vs MiMo-V2.5 (medium)

Gemini 3.1 Flash Lite (low) führt beim Durchschnittsscore mit 6.6 vs 6.4. MiMo-V2.5 (medium) hat die niedrigeren Benchmark-Kosten mit $0.104 vs $0.621. Gemini 3.1 Flash Lite (low) ist schneller mit 16.25s vs 46.28s, mit Erfolgsraten von 63.6% vs 68.2%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-08-20

Rang
#149
Gesamte Ausgabe-Token
397,891
Antwortzeit (Durchschnitt)
16.25s
Gesamtkosten
$0.621
Rang
#160
Gesamte Ausgabe-Token
327,048
Antwortzeit (Durchschnitt)
46.28s
Gesamtkosten
$0.104
Empfohlenes Modell MiMo-V2.5 (medium)

Die Punktzahl bleibt nah an der besten hier (6.4 vs 6.6) und es kostet etwa 6.0x weniger als Gemini 3.1 Flash Lite (low).

Detaillierter Vergleich

Metrik Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Veröffentlichung: 2026-05-08 MiMo-V2.5 MiMo-V2.5 medium Veröffentlichung: 2026-04-22
Punktzahl 6.6 6.4
Rang #149 #160
Zuverlässigkeit 10.0 10.0
Konsistenz 9.2 7.5
Versuche 66/66 66/66
Korrekte Tests
Erfolgsquote pro Versuch 63.6% 68.2%
Instabile Tests 2 7
Gesamtläufe 66 66
Kosten pro Ergebnis 4.773 3.575
Gesamtkosten $0.621 $0.104
Eingabepreis $0.250 / 1M $0.140 / 1M
Ausgabepreis $1.500 / 1M $0.280 / 1M
Gesamte Eingabe-Token 94,233 105,456
Ausgabe-Token 7,759 7,108
Denk-Token 390,132 319,940
Antwortzeit (Durchschnitt) 16.25s 46.28s
Antwortzeit (Maximum) 318.02s 316.27s
Antwortzeit (Gesamt) 357.39s 1018.12s
Parameter ~150B insgesamt (~10B aktiv) 310B insgesamt (15B aktiv)
Verfügbarkeit Geschlossen Open Source

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#149 Gemini 3.1 Flash Lite

low
Kosten
$0.003
Zeit
4.0s
Token
1,479 tok

#160 MiMo-V2.5

medium
Kosten
$0.002
Zeit
54.8s
Token
5,247 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 1.53s 8,132 471 1,072
MiMo-V2.5 6.2 4.7 66.7% 2 97.14s 7,422 557 81,977

Schnellvergleich

Vergleichspaar wechseln