Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Nemotron 3.5 Lightning (medium) vs MiMo-V2.5-Pro

MiMo-V2.5-Pro führt beim Durchschnittsscore mit 5.4 vs 5.1. MiMo-V2.5-Pro hat die niedrigeren Benchmark-Kosten mit $0.068 vs $0.195. MiMo-V2.5-Pro ist schneller mit 4.24s vs 70.11s, mit Erfolgsraten von 48.5% vs 33.3%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-08-15

Rang
#232
Gesamte Ausgabe-Token
760,441
Antwortzeit (Durchschnitt)
70.11s
Gesamtkosten
$0.195
Rang
#220
Gesamte Ausgabe-Token
15,362
Antwortzeit (Durchschnitt)
4.24s
Gesamtkosten
$0.068
Empfohlenes Modell MiMo-V2.5-Pro

Es hat hier die beste Punktzahl (5.4) und kostet etwa 2.9x weniger als Nemotron 3.5 Lightning (medium).

Detaillierter Vergleich

Metrik Nemotron 3.5 Lightning Nemotron 3.5 Lightning medium Veröffentlichung: 2026-08-11 Kostenlos verfügbar MiMo-V2.5-Pro MiMo-V2.5-Pro none Veröffentlichung: 2026-04-22
Punktzahl 5.1 5.4
Rang #232 #220
Zuverlässigkeit 9.9 10.0
Konsistenz 6.0 8.6
Versuche 66/66 66/66
Korrekte Tests
Erfolgsquote pro Versuch 48.5% 33.3%
Instabile Tests 11 4
Gesamtläufe 66 66
Kosten pro Ergebnis 0.000 1.808
Gesamtkosten $0.195 $0.068
Eingabepreis $0.100 / 1M $0.435 / 1M
Ausgabepreis $0.250 / 1M $0.870 / 1M
Gesamte Eingabe-Token 126,330 124,808
Ausgabe-Token 165,702 15,362
Denk-Token 594,739 0
Antwortzeit (Durchschnitt) 70.11s 4.24s
Antwortzeit (Maximum) 437.11s 53.13s
Antwortzeit (Gesamt) 1542.52s 93.28s
Parameter 30B insgesamt (3B aktiv) 1.02T insgesamt (42B aktiv)
Verfügbarkeit Gewichte verfügbar Open Source

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#232 Nemotron 3.5 Lightning

medium
Kosten
$0.000
Zeit
130.5s
Token
6,750 tok

#220 MiMo-V2.5-Pro

none
Kosten
$0.004
Zeit
46.4s
Token
4,025 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Nemotron 3.5 Lightning 4.4 5.1 33.3% 2 285.47s 7,623 78,065 297,359
MiMo-V2.5-Pro 4.3 7.8 22.2% 1 1.41s 6,559 485 0

Schnellvergleich

Vergleichspaar wechseln