नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Inception: Mercury 2 vs xAI: Grok 4.1 Fast

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-05-01

मेट्रिक Mercury 2 Mercury 2 none रिलीज़: 2026-02-24 Grok 4.1 Fast Grok 4.1 Fast none रिलीज़: 2025-11-19
स्कोर 4.8 4.5
रैंक #125 #130
विश्वसनीयता लागू नहीं लागू नहीं
संगति 9.0 8.7
सही परीक्षण
प्रति प्रयास पास दर 27.8% 24.1%
अस्थिर टेस्ट 2 3
कुल रन 54 54
प्रति परिणाम लागत 0.165 0.269
कुल लागत $0.007 $0.009
???? ??? $0.250 / 1M $0.200 / 1M
????? ??? $0.750 / 1M $0.500 / 1M
आउटपुट टोकन 1,625 1,721
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 613ms 1.76s
प्रतिक्रिया समय (अधिकतम) 1.27s 5.51s
प्रतिक्रिया समय (कुल) 11.04s 19.35s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.0 10.0 0.0% 0 483ms 286 0
Grok 4.1 Fast 3.2 10.0 0.0% 0 1.07s 235 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.6 8.9 0.0% 0 969ms 310 0
Grok 4.1 Fast 5.3 3.4 33.3% 1 1.79s 567 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.0 10.0 0.0% 0 606ms 131 0
Grok 4.1 Fast 3.0 10.0 0.0% 0 3.33s 105 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 7.3 5.9 83.3% 1 667ms 180 0
Grok 4.1 Fast 10.0 10.0 100.0% 0 943ms 180 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 5.3 7.2 44.4% 1 534ms 46 0
Grok 4.1 Fast 5.9 7.2 55.6% 1 1.06s 15 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 4.8 10.0 0.0% 0 628ms 159 0
Grok 4.1 Fast 4.4 9.9 0.0% 0 1.08s 112 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 6.5 10.0 50.0% 0 551ms 82 0
Grok 4.1 Fast 3.0 10.0 0.0% 0 923ms 56 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.1 10.0 0.0% 0 533ms 234 0
Grok 4.1 Fast 3.2 10.0 0.0% 0 1.28s 243 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 10.0 10.0 100.0% 0 1.27s 197 0
Grok 4.1 Fast 2.8 1.6 33.3% 1 5.51s 208 0

त्वरित तुलना

तुलना जोड़ी बदलें