नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

MiniMax M2.5 (medium) vs gpt-oss-120b

MiniMax M2.5 (medium) average score में आगे है: 4.3 vs 4.2. gpt-oss-120b की benchmark लागत कम है: $0.016 vs $0.440. gpt-oss-120b तेज है: 28.63s vs 102.32s, pass rates 42.0% vs 34.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#359
कुल आउटपुट टोकन
284,991
प्रतिक्रिया समय (औसत)
102.32s
कुल लागत
$0.440
रैंक
#361
कुल आउटपुट टोकन
62,213
प्रतिक्रिया समय (औसत)
28.63s
कुल लागत
$0.016
अनुशंसित मॉडल gpt-oss-120b

Its score stays close to the best score here (4.2 vs 4.3), while costing about 28.4x less than MiniMax M2.5 (medium).

विस्तृत तुलना

मेट्रिक MiniMax M2.5 MiniMax M2.5 medium रिलीज़: 2026-02-12 gpt-oss-120b gpt-oss-120b none रिलीज़: 2025-08-05
स्कोर 4.3 4.2
रैंक #359 #361
विश्वसनीयता 9.3 10.0
संगति 6.8 7.6
प्रयास 69/69 60/69
सही परीक्षण
प्रति प्रयास पास दर 42.0% 34.8%
अस्थिर टेस्ट 9 3
कुल रन 69 60
प्रति परिणाम लागत 7.104 0.274
कुल लागत $0.440 $0.016
इनपुट कीमत $0.270 / 1M $0.037 / 1M
आउटपुट कीमत $1.080 / 1M $0.170 / 1M
कैश पढ़ने की कीमत $0.027 / 1M लागू नहीं
कैश लिखने की कीमत लागू नहीं लागू नहीं
कुल इनपुट टोकन 188,239 131,652
आउटपुट टोकन 27,822 16,869
रीजनिंग टोकन 262,674 53,081
प्रतिक्रिया समय (औसत) 102.32s 28.63s
प्रतिक्रिया समय (अधिकतम) 600.81s 140.90s
प्रतिक्रिया समय (कुल) 1637.05s 486.69s
पैरामीटर 230B कुल (10B सक्रिय) 117B कुल (5.1B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#359 MiniMax M2.5

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
लागत
$0.000
समय
300.0s
टोकन
0 tok

#361 gpt-oss-120b

none
इस मॉडल के लिए अभी तक कोई शोकेस परिणाम उत्पन्न नहीं हुआ है।
लागत
लागू नहीं
समय
-
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.5 3.4 9.1 0.0% 0 188.58s 6,076 357 106,177
gpt-oss-120b 1.5 0.4 22.2% 1 9.57s 901 204 3,028

तुलना जोड़ी बदलें

gpt-oss-120bnonevsGLM 4.7 FlashmediumMercury 2nonevsMiniMax M2.5mediumGranite 4.2 8BnonevsMiniMax M2.5mediumgpt-oss-120bnonevsQwen3.5-9BmediumTrinity Large Previewdefaultनिःशुल्क उपलब्धvsMiniMax M2.5mediumKAT Coder AIR V2.5defaultvsMiniMax M2.5mediumMercury 2.5nonevsMiniMax M2.5mediumMiniMax M2.5mediumvsNemotron 3 Supernoneनिःशुल्क उपलब्धRing 2.6 1tdefaultvsMiniMax M2.5mediumCobuddymediumनिःशुल्क उपलब्धvsgpt-oss-120bnoneLing 2.6 FlashdefaultvsMiniMax M2.5mediumTrinity Large Previewdefaultनिःशुल्क उपलब्धvsgpt-oss-120bnone