नेविगेशन
AI BENCHY
Advertise here

AI BENCHY तुलना

Inception: Mercury 2 vs MiniMax: MiniMax M2.7

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-03

मेट्रिक Mercury 2 Mercury 2 none रिलीज़: 2026-02-24 MiniMax M2.7 MiniMax M2.7 medium रिलीज़: 2026-03-18
स्कोर 4.6 5.4
रैंक #153 #128
विश्वसनीयता 10.0 10.0
संगति 9.1 6.8
सही परीक्षण
प्रति प्रयास पास दर 25.0% 48.3%
अस्थिर टेस्ट 2 8
कुल रन 60 60
प्रति परिणाम लागत 0.216 2.076
कुल लागत $0.009 $0.104
इनपुट कीमत $0.250 / 1M $0.279 / 1M
आउटपुट कीमत $0.750 / 1M $1.200 / 1M
कुल इनपुट टोकन 25,515 33,493
आउटपुट टोकन 3,001 8,224
रीजनिंग टोकन 0 73,373
प्रतिक्रिया समय (औसत) 614ms 29.86s
प्रतिक्रिया समय (अधिकतम) 1.27s 117.04s
प्रतिक्रिया समय (कुल) 12.28s 567.39s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.0 10.0 0.0% 0 483ms 631 286 0
MiniMax M2.7 7.9 6.3 83.3% 2 40.32s 654 3,010 17,716
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.5 9.4 0.0% 0 831ms 4,631 1,650 0
MiniMax M2.7 6.7 9.7 50.0% 0 54.73s 2,083 474 22,402
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.0 10.0 0.0% 0 606ms 4,821 131 0
MiniMax M2.7 4.7 1.6 66.7% 1 41.03s 14,233 369 4,480
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 7.3 5.9 83.3% 1 667ms 6,362 180 0
MiniMax M2.7 6.3 5.8 66.7% 1 21.95s 7,152 187 5,882
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 5.3 7.2 44.4% 1 534ms 784 46 0
MiniMax M2.7 3.0 10.0 0.0% 0 19.00s 245 8 2,796
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 4.8 10.0 0.0% 0 628ms 495 159 0
MiniMax M2.7 3.9 2.5 33.3% 1 38.70s 486 92 5,204
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 6.5 10.0 50.0% 0 551ms 691 82 0
MiniMax M2.7 3.8 5.8 33.3% 1 12.80s 687 350 2,600
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.1 10.0 0.0% 0 535ms 694 251 0
MiniMax M2.7 5.9 7.2 55.6% 1 24.87s 675 362 7,840
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 10.0 10.0 100.0% 0 1.27s 6,193 197 0
MiniMax M2.7 4.7 1.6 66.7% 1 12.05s 7,067 304 1,001
सामान्य ज्ञान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.0 10.0 0.0% 0 548ms 213 19 0
MiniMax M2.7 3.0 10.0 0.0% 0 22.77s 211 3,068 3,452

त्वरित तुलना

तुलना जोड़ी बदलें