Navigation
Advertise here

MiniMax M2.5 (medium) vs gpt-oss-120b

MiniMax M2.5 (medium) führt beim Durchschnittsscore mit 4.3 vs 4.2. gpt-oss-120b hat die niedrigeren Benchmark-Kosten mit $0.016 vs $0.440. gpt-oss-120b ist schneller mit 28.63s vs 102.32s, mit Erfolgsraten von 42.0% vs 34.8%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-07

Verglichene Modelle

Rang
#359
Gesamte Ausgabe-Token
284,991
Antwortzeit (Durchschnitt)
102.32s
Gesamtkosten
$0.440
Rang
#361
Gesamte Ausgabe-Token
62,213
Antwortzeit (Durchschnitt)
28.63s
Gesamtkosten
$0.016
Empfohlenes Modell gpt-oss-120b

Die Punktzahl bleibt nah an der besten hier (4.2 vs 4.3) und es kostet etwa 28.4x weniger als MiniMax M2.5 (medium).

Detaillierter Vergleich

Metrik MiniMax M2.5 MiniMax M2.5 medium Veröffentlichung: 2026-02-12 gpt-oss-120b gpt-oss-120b none Veröffentlichung: 2025-08-05
Punktzahl 4.3 4.2
Rang #359 #361
Zuverlässigkeit 9.3 10.0
Konsistenz 6.8 7.6
Versuche 69/69 60/69
Korrekte Tests
Erfolgsquote pro Versuch 42.0% 34.8%
Instabile Tests 9 3
Gesamtläufe 69 60
Kosten pro Ergebnis 7.104 0.274
Gesamtkosten $0.440 $0.016
Eingabepreis $0.270 / 1M $0.037 / 1M
Ausgabepreis $1.080 / 1M $0.170 / 1M
Preis für Cache-Lesen $0.027 / 1M k. A.
Preis für Cache-Schreiben k. A. k. A.
Gesamte Eingabe-Token 188,239 131,652
Ausgabe-Token 27,822 16,869
Denk-Token 262,674 53,081
Antwortzeit (Durchschnitt) 102.32s 28.63s
Antwortzeit (Maximum) 600.81s 140.90s
Antwortzeit (Gesamt) 1637.05s 486.69s
Parameter 230B insgesamt (10B aktiv) 117B insgesamt (5.1B aktiv)
Verfügbarkeit Gewichte verfügbar Open Source

Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#359 MiniMax M2.5

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
Kosten
$0.000
Zeit
300.0s
Token
0 tok

#361 gpt-oss-120b

none
Für dieses Modell wurde noch kein Showcase-Ergebnis generiert.
Kosten
k. A.
Zeit
-
Token
0 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
MiniMax M2.5 3.4 9.1 0.0% 0 188.58s 6,076 357 106,177
gpt-oss-120b 1.5 0.4 22.2% 1 9.57s 901 204 3,028

Vergleichspaar wechseln