नेविगेशन
AI BENCHY
Advertise here

MiniMax M3 (medium) vs Grok Build 0.1 (medium)

average score लगभग बराबर है: 7.5 vs 7.5. MiniMax M3 (medium) की benchmark लागत कम है: $0.300 vs $1.130. Grok Build 0.1 (medium) तेज है: 54.50s vs 75.15s, pass rates 62.1% vs 60.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#84
कुल आउटपुट टोकन
275,782
प्रतिक्रिया समय (औसत)
75.15s
कुल लागत
$0.300
रैंक
#89
कुल आउटपुट टोकन
511,406
प्रतिक्रिया समय (औसत)
54.50s
कुल लागत
$1.130
अनुशंसित मॉडल MiniMax M3 (medium)

It has the best score here (7.5), while costing about 3.8x less than Grok Build 0.1 (medium).

विस्तृत तुलना

मेट्रिक MiniMax M3 MiniMax M3 medium रिलीज़: 2026-06-01 Grok Build 0.1 Grok Build 0.1 medium रिलीज़: 2026-05-21
स्कोर 7.5 7.5
रैंक #84 #89
विश्वसनीयता 9.7 10.0
संगति 8.0 9.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 62.1% 60.6%
अस्थिर टेस्ट 5 1
कुल रन 66 66
प्रति परिणाम लागत 2.724 8.691
कुल लागत $0.300 $1.130
इनपुट कीमत $0.300 / 1M $1.000 / 1M
आउटपुट कीमत $1.200 / 1M $2.000 / 1M
कुल इनपुट टोकन 121,996 106,946
आउटपुट टोकन 90,051 7,993
रीजनिंग टोकन 185,731 503,413
प्रतिक्रिया समय (औसत) 75.15s 54.50s
प्रतिक्रिया समय (अधिकतम) 431.03s 252.69s
प्रतिक्रिया समय (कुल) 1578.24s 1199.07s
पैरामीटर 428B कुल (23B सक्रिय) ~300B कुल (~30B सक्रिय)
उपलब्धता वेट उपलब्ध बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#84 MiniMax M3

medium
लागत
$0.012
समय
154.4s
टोकन
10,018 tok

#89 SpaceXAI: Grok Build 0.1

medium
लागत
$0.028
समय
81.3s
टोकन
14,009 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
MiniMax M3 6.1 6.5 55.6% 1 144.74s 5,804 6,223 32,667
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

त्वरित तुलना

तुलना जोड़ी बदलें