Navigation
AI BENCHY
Your ad here

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs Xiaomi: MiMo-V2-Pro

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-03-20

Metrik Claude Sonnet 4.6 Claude Sonnet 4.6 medium Veröffentlichung: 2026-02-17 MiMo-V2-Pro MiMo-V2-Pro medium Veröffentlichung: 2026-03-18
Punktzahl 7.9 8.0
Rang #21 #20
Konsistenz 9.5 8.5
Korrekte Tests
Erfolgsquote pro Versuch 72.6% 76.5%
Instabile Tests 1 3
Gesamtläufe 51 45
Kosten pro Ergebnis 8.531 1.110
Gesamtkosten $1.024 $0.123
Eingabepreis $3.000 / 1M $1.000 / 1M
Ausgabepreis $15.000 / 1M $3.000 / 1M
Ausgabe-Token 35,174 1,875
Denk-Token 24,687 26,959
Antwortzeit (Durchschnitt) 10.09s 9.78s
Antwortzeit (Maximum) 46.35s 64.71s
Antwortzeit (Gesamt) 90.85s 156.45s

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Anti-KI-Tricks Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 6.5 10.0 50.0% 0 2.98s 1,046 1,093
MiMo-V2-Pro 10.0 10.0 100.0% 0 3.06s 223 1,107
Kombiniert Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 10.0 10.0 100.0% 0 46.35s 5,871 3,962
MiMo-V2-Pro 4.7 1.6 66.7% 1 64.71s 380 14,186
Datenanalyse und -extraktion Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 10.0 10.0 100.0% 0 13.90s 649 742
MiMo-V2-Pro 7.3 5.8 83.3% 1 17.20s 260 7,484
Domänenspezifisch Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 2.9 7.2 11.1% 1 0ms 25,790 16,919
MiMo-V2-Pro 5.3 10.0 33.3% 0 6.00s 155 1,048
Allgemeine Intelligenz Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.94s 256 433
MiMo-V2-Pro 10.0 10.0 100.0% 0 4.06s 198 424
Befolgung von Anweisungen Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 10.0 10.0 100.0% 0 2.61s 318 552
MiMo-V2-Pro 9.9 10.0 100.0% 0 3.36s 83 667
Puzzle Solving Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.80s 589 635
MiMo-V2-Pro 7.0 7.2 55.6% 1 4.71s 313 1,179
Werkzeugaufrufe Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
Claude Sonnet 4.6 10.0 10.0 100.0% 0 7.48s 655 351
MiMo-V2-Pro 10.0 10.0 100.0% 0 8.19s 263 864

Schnellvergleich

Vergleichspaar wechseln