नेविगेशन
AI BENCHY
Advertise here

MiniMax M3 (medium) vs GPT 5.3 Chat

average score लगभग बराबर है: 7.5 vs 7.5. MiniMax M3 (medium) की benchmark लागत कम है: $0.300 vs $0.533. GPT 5.3 Chat तेज है: 6.56s vs 75.15s, pass rates 62.1% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#85
कुल आउटपुट टोकन
275,782
प्रतिक्रिया समय (औसत)
75.15s
कुल लागत
$0.300
रैंक
#86
कुल आउटपुट टोकन
28,179
प्रतिक्रिया समय (औसत)
6.56s
कुल लागत
$0.533
अनुशंसित मॉडल GPT 5.3 Chat

It has the best score here (7.5), while responding about 11.5x faster than MiniMax M3 (medium).

विस्तृत तुलना

मेट्रिक MiniMax M3 MiniMax M3 medium रिलीज़: 2026-06-01 GPT 5.3 Chat GPT 5.3 Chat none रिलीज़: 2026-03-03
स्कोर 7.5 7.5
रैंक #85 #86
विश्वसनीयता 9.7 10.0
संगति 8.0 8.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 62.1% 65.2%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 2.724 4.097
कुल लागत $0.300 $0.533
इनपुट कीमत $0.300 / 1M $1.750 / 1M
आउटपुट कीमत $1.200 / 1M $14.000 / 1M
कुल इनपुट टोकन 121,996 78,846
आउटपुट टोकन 90,051 28,179
रीजनिंग टोकन 185,731 0
प्रतिक्रिया समय (औसत) 75.15s 6.56s
प्रतिक्रिया समय (अधिकतम) 431.03s 18.33s
प्रतिक्रिया समय (कुल) 1578.24s 137.77s
पैरामीटर 428B कुल (23B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#85 MiniMax M3

medium
लागत
$0.012
समय
154.4s
टोकन
10,018 tok

#86 GPT 5.3 Chat

none
लागत
$0.008
समय
8.1s
टोकन
634 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M3 6.1 6.5 55.6% 1 144.74s 5,804 6,223 32,667
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

त्वरित तुलना

तुलना जोड़ी बदलें