Navigation
Advertise here

Kimi K2.5 vs MiMo-V2.6-Flash

MiMo-V2.6-Flash führt beim Durchschnittsscore mit 5.4 vs 5.3. MiMo-V2.6-Flash hat die niedrigeren Benchmark-Kosten mit $0.060 vs $0.262. MiMo-V2.6-Flash ist schneller mit 6.20s vs 35.86s, mit Erfolgsraten von 29.0% vs 30.4%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-07

Verglichene Modelle

Rang
#299
Gesamte Ausgabe-Token
49,389
Antwortzeit (Durchschnitt)
35.86s
Gesamtkosten
$0.262
Rang
#293
Gesamte Ausgabe-Token
75,728
Antwortzeit (Durchschnitt)
6.20s
Gesamtkosten
$0.060
Empfohlenes Modell MiMo-V2.6-Flash

Es hat hier die beste Punktzahl (5.4) und kostet etwa 4.4x weniger als Kimi K2.5.

Detaillierter Vergleich

Metrik Kimi K2.5 Kimi K2.5 none Veröffentlichung: 2026-01-27 MiMo-V2.6-Flash MiMo-V2.6-Flash none Veröffentlichung: 2026-09-22
Punktzahl 5.3 5.4
Rang #299 #293
Zuverlässigkeit 10.0 10.0
Konsistenz 8.6 9.2
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 29.0% 30.4%
Instabile Tests 4 2
Gesamtläufe 69 69
Kosten pro Ergebnis 4.976 1.000
Gesamtkosten $0.262 $0.060
Eingabepreis $0.450 / 1M $0.140 / 1M
Ausgabepreis $2.250 / 1M $0.280 / 1M
Preis für Cache-Lesen $0.070 / 1M $0.003 / 1M
Preis für Cache-Schreiben k. A. k. A.
Gesamte Eingabe-Token 275,349 276,697
Ausgabe-Token 49,377 75,728
Denk-Token 12 0
Antwortzeit (Durchschnitt) 35.86s 6.20s
Antwortzeit (Maximum) 321.19s 62.57s
Antwortzeit (Gesamt) 609.61s 142.63s
Parameter 1T insgesamt (32B aktiv) 309B insgesamt (15B aktiv)
Verfügbarkeit Gewichte verfügbar Open Source

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#299 MoonshotAI: Kimi K2.5

none
Kosten
$0.015
Zeit
89.1s
Token
5,421 tok

#293 MiMo-V2.6-Flash

none
Kosten
$0.008
Zeit
173.0s
Token
28,061 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Kimi K2.5 5.5 10.0 33.3% 0 24.56s 7,311 4,708 0
MiMo-V2.6-Flash 3.7 7.6 11.1% 1 744ms 7,440 558 0

Vergleichspaar wechseln