नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

Inception: Mercury 2 vs OpenAI: GPT-5.5

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-24

मेट्रिक Mercury 2 Mercury 2 medium रिलीज़: 2026-02-24 GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24
स्कोर 6.5 6.8
रैंक #64 #58
विश्वसनीयता लागू नहीं लागू नहीं
संगति 8.6 8.3
सही परीक्षण
प्रति प्रयास पास दर 53.7% 61.1%
अस्थिर टेस्ट 3 4
कुल रन 54 54
प्रति परिणाम लागत 0.580 2.162
कुल लागत $0.047 $0.195
???? ??? $0.250 / 1M $5.000 / 1M
????? ??? $0.750 / 1M $30.000 / 1M
आउटपुट टोकन 3,972 1,910
रीजनिंग टोकन 48,333 0
प्रतिक्रिया समय (औसत) 2.21s 1.83s
प्रतिक्रिया समय (अधिकतम) 14.63s 5.56s
प्रतिक्रिया समय (कुल) 37.51s 32.86s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 6.9 9.9 50.0% 0 1.12s 2,546 2,609
GPT-5.5 6.9 7.9 66.7% 1 1.31s 213 0
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 10.0 10.0 100.0% 0 1.53s 249 2,213
GPT-5.5 10.0 10.0 100.0% 0 2.05s 426 0
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
GPT-5.5 3.0 10.0 0.0% 0 5.56s 300 0
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 7.3 5.9 83.3% 1 1.11s 183 1,656
GPT-5.5 10.0 10.0 100.0% 0 1.18s 222 0
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 2.9 7.2 11.1% 1 6.48s 41 30,754
GPT-5.5 2.9 7.2 11.1% 1 1.31s 52 0
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 4.8 10.0 0.0% 0 821ms 137 542
GPT-5.5 10.0 10.0 100.0% 0 3.41s 124 0
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
GPT-5.5 6.2 5.8 66.7% 1 1.15s 81 0
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 3.9 7.5 22.2% 1 934ms 354 2,758
GPT-5.5 6.7 7.9 55.6% 1 1.36s 245 0
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956
GPT-5.5 10.0 10.0 100.0% 0 3.90s 247 0

त्वरित तुलना

तुलना जोड़ी बदलें