नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

MiniMax: MiniMax M2.5 vs xAI: Grok 4.20

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-02

मेट्रिक MiniMax M2.5 MiniMax M2.5 medium रिलीज़: 2026-02-12 निःशुल्क उपलब्ध Grok 4.20 Grok 4.20 none रिलीज़: 2026-03-31
स्कोर 5.9 5.4
रैंक #60 #69
संगति 5.4 9.5
सही परीक्षण
प्रति प्रयास पास दर 60.8% 31.4%
अस्थिर टेस्ट 10 1
कुल रन 51 51
प्रति परिणाम लागत 4.987 1.809
कुल लागत $0.250 $0.091
???? ??? $0.118 / 1M $2.000 / 1M
????? ??? $1.000 / 1M $6.000 / 1M
आउटपुट टोकन 107,044 1,655
रीजनिंग टोकन 206,422 0
प्रतिक्रिया समय (औसत) 39.65s 1.11s
प्रतिक्रिया समय (अधिकतम) 237.27s 6.04s
प्रतिक्रिया समय (कुल) 396.47s 18.80s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.5 7.9 6.3 83.3% 2 20.82s 286 45,344
Grok 4.20 4.8 10.0 25.0% 0 501ms 267 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.5 4.5 2.1 66.7% 1 60.39s 740 9,713
Grok 4.20 3.0 10.0 0.0% 0 6.04s 282 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.5 4.6 1.7 66.7% 2 7.48s 266 3,835
Grok 4.20 10.0 10.0 100.0% 0 522ms 207 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.5 2.9 4.4 22.2% 2 237.27s 105,047 133,487
Grok 4.20 3.0 10.0 0.0% 0 687ms 325 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.5 3.8 2.5 33.3% 1 6.63s 25 1,686
Grok 4.20 4.8 10.0 0.0% 0 659ms 83 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.5 8.1 6.8 83.3% 1 4.64s 252 1,873
Grok 4.20 4.8 10.0 0.0% 0 455ms 60 0
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.5 5.3 7.2 44.4% 1 11.54s 159 9,547
Grok 4.20 5.3 7.4 44.4% 1 487ms 242 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.5 10.0 10.0 100.0% 0 15.35s 269 937
Grok 4.20 10.0 10.0 100.0% 0 4.63s 189 0

त्वरित तुलना

तुलना जोड़ी बदलें