Navigation
AI BENCHY
Advertise here

AI BENCHY Compare

MiniMax: MiniMax M2.5 vs Qwen: Qwen3.5-122B-A10B

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-05-29

Metrik MiniMax M2.5 MiniMax M2.5 medium Veröffentlichung: 2026-02-12 Kostenlos verfügbar Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Veröffentlichung: 2026-02-24
Punktzahl 5.5 5.4
Rang #123 #130
Zuverlässigkeit 10.0 10.0
Konsistenz 6.4 9.5
Korrekte Tests
Erfolgsquote pro Versuch 48.3% 33.3%
Instabile Tests 9 1
Gesamtläufe 60 60
Kosten pro Ergebnis 6.075 0.380
Gesamtkosten $0.304 $0.023
Eingabepreis $0.150 / 1M $0.260 / 1M
Ausgabepreis $1.150 / 1M $2.080 / 1M
Ausgabe-Token 109,492 3,374
Denk-Token 251,674 0
Antwortzeit (Durchschnitt) 49.87s 3.38s
Antwortzeit (Maximum) 237.27s 46.00s
Antwortzeit (Gesamt) 598.39s 67.55s

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Anti-KI-Tricks Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
MiniMax M2.5 7.9 6.3 83.3% 2 20.82s 286 45,344
Qwen3.5-122B-A10B 4.8 10.0 25.0% 0 1.59s 312 0
Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
MiniMax M2.5 3.5 9.8 0.0% 0 125.80s 354 27,037
Qwen3.5-122B-A10B 4.0 5.5 33.3% 1 2.14s 684 0
Kombiniert Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
MiniMax M2.5 4.5 2.1 66.7% 1 60.39s 740 9,713
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 46.00s 1,137 0
Datenanalyse und -extraktion Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
MiniMax M2.5 4.6 1.7 66.7% 2 7.48s 266 3,835
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 1.01s 243 0
Domänenspezifisch Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
MiniMax M2.5 2.9 4.4 22.2% 2 237.27s 105,047 133,487
Qwen3.5-122B-A10B 5.3 10.0 33.3% 0 465ms 15 0
Allgemeine Intelligenz Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
MiniMax M2.5 3.8 2.5 33.3% 1 6.63s 25 1,686
Qwen3.5-122B-A10B 5.0 10.0 0.0% 0 1.12s 66 0
Befolgung von Anweisungen Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
MiniMax M2.5 7.5 10.0 50.0% 0 621ms 156 1,495
Qwen3.5-122B-A10B 6.3 10.0 50.0% 0 513ms 69 0
Rätsellösen Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
MiniMax M2.5 5.3 7.2 44.4% 1 11.21s 1,069 9,605
Qwen3.5-122B-A10B 3.8 10.0 0.0% 0 1.00s 575 0
Werkzeugaufrufe Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
MiniMax M2.5 10.0 10.0 100.0% 0 15.35s 269 937
Qwen3.5-122B-A10B 10.0 10.0 100.0% 0 2.04s 264 0
Allgemeinwissen Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Ausgabe-Token Denk-Token
MiniMax M2.5 3.0 10.0 0.0% 0 80.79s 1,280 18,535
Qwen3.5-122B-A10B 3.0 10.0 0.0% 0 295ms 9 0

Schnellvergleich

Vergleichspaar wechseln