Navigation
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Laguna XS 2.1 vs MiMo-V2.5-Pro

MiMo-V2.5-Pro führt beim Durchschnittsscore mit 5.4 vs 5.3. Laguna XS 2.1 hat die niedrigeren Benchmark-Kosten mit $0.008 vs $0.068. Laguna XS 2.1 ist schneller mit 1.55s vs 4.24s, mit Erfolgsraten von 30.3% vs 33.3%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-08-15

Rang
#225
Gesamte Ausgabe-Token
13,377
Antwortzeit (Durchschnitt)
1.55s
Gesamtkosten
$0.008
Rang
#220
Gesamte Ausgabe-Token
15,362
Antwortzeit (Durchschnitt)
4.24s
Gesamtkosten
$0.068
Empfohlenes Modell Laguna XS 2.1

Die Punktzahl bleibt nah an der besten hier (5.3 vs 5.4) und es kostet etwa 9.5x weniger als MiMo-V2.5-Pro.

Detaillierter Vergleich

Metrik Laguna XS 2.1 Laguna XS 2.1 none Veröffentlichung: 2026-07-02 Kostenlos verfügbar MiMo-V2.5-Pro MiMo-V2.5-Pro none Veröffentlichung: 2026-04-22
Punktzahl 5.3 5.4
Rang #225 #220
Zuverlässigkeit 10.0 10.0
Konsistenz 9.0 8.6
Versuche 66/66 66/66
Korrekte Tests
Erfolgsquote pro Versuch 30.3% 33.3%
Instabile Tests 3 4
Gesamtläufe 66 66
Kosten pro Ergebnis 0.143 1.808
Gesamtkosten $0.008 $0.068
Eingabepreis $0.060 / 1M $0.435 / 1M
Ausgabepreis $0.120 / 1M $0.870 / 1M
Gesamte Eingabe-Token 91,607 124,808
Ausgabe-Token 13,377 15,362
Denk-Token 0 0
Antwortzeit (Durchschnitt) 1.55s 4.24s
Antwortzeit (Maximum) 19.02s 53.13s
Antwortzeit (Gesamt) 34.01s 93.28s
Parameter 33B insgesamt (3B aktiv) 1.02T insgesamt (42B aktiv)
Verfügbarkeit Gewichte verfügbar Open Source

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#225 Laguna XS 2.1

none
Kosten
$0.001
Zeit
27.6s
Token
4,344 tok

#220 MiMo-V2.5-Pro

none
Kosten
$0.004
Zeit
46.4s
Token
4,025 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Laguna XS 2.1 4.3 7.8 22.2% 1 623ms 7,995 562 0
MiMo-V2.5-Pro 4.3 7.8 22.2% 1 1.41s 6,559 485 0

Schnellvergleich

Vergleichspaar wechseln