नेविगेशन
AI BENCHY
Your ad here

AI BENCHY तुलना

MiniMax: MiniMax M2.7 vs OpenAI: GPT-5.4

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-03-20

मेट्रिक MiniMax M2.7 MiniMax M2.7 medium रिलीज़: 2026-03-18 GPT-5.4 GPT-5.4 none रिलीज़: 2026-03-05
स्कोर 5.0 5.6
रैंक #66 #55
संगति 5.3 9.0
सही परीक्षण
प्रति प्रयास पास दर 49.0% 39.2%
अस्थिर टेस्ट 10 2
कुल रन 51 51
प्रति परिणाम लागत 2.398 1.573
कुल लागत $0.072 $0.095
???? ??? $0.300 / 1M $2.500 / 1M
????? ??? $1.200 / 1M $15.000 / 1M
आउटपुट टोकन 4,517 1,837
रीजनिंग टोकन 47,612 0
प्रतिक्रिया समय (औसत) 27.32s 1.43s
प्रतिक्रिया समय (अधिकतम) 117.04s 2.89s
प्रतिक्रिया समय (कुल) 437.10s 24.27s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 7.9 6.3 83.3% 2 40.32s 3,010 17,716
GPT-5.4 3.2 8.0 8.3% 1 1.21s 406 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 4.7 1.6 66.7% 1 41.03s 369 4,480
GPT-5.4 3.0 10.0 0.0% 0 2.89s 291 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 6.3 5.8 66.7% 1 21.95s 187 5,882
GPT-5.4 10.0 10.0 100.0% 0 1.04s 222 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 3.0 10.0 0.0% 0 19.00s 8 2,796
GPT-5.4 5.3 7.2 44.4% 1 1.07s 50 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 3.9 2.5 33.3% 1 38.70s 92 5,204
GPT-5.4 4.4 9.9 0.0% 0 1.78s 184 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 3.7 1.8 50.0% 2 12.64s 213 2,457
GPT-5.4 6.5 10.0 50.0% 0 1.07s 81 0
Puzzle Solving स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 3.8 4.5 33.3% 2 25.62s 334 8,076
GPT-5.4 5.6 9.8 33.3% 0 1.52s 357 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
MiniMax M2.7 4.7 1.6 66.7% 1 12.05s 304 1,001
GPT-5.4 10.0 10.0 100.0% 0 2.75s 246 0

त्वरित तुलना

तुलना जोड़ी बदलें