नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY तुलना

DeepSeek: DeepSeek V4 Pro vs Inception: Mercury 2

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-24

मेट्रिक DeepSeek V4 Pro DeepSeek V4 Pro none रिलीज़: 2026-04-24 Mercury 2 Mercury 2 medium रिलीज़: 2026-02-24
स्कोर 6.7 6.5
रैंक #59 #62
संगति 9.5 8.6
सही परीक्षण
प्रति प्रयास पास दर 51.9% 53.7%
अस्थिर टेस्ट 1 3
कुल रन 26 54
प्रति परिणाम लागत 0.317 0.580
कुल लागत $0.029 $0.047
???? ??? $1.740 / 1M $0.250 / 1M
????? ??? $3.480 / 1M $0.750 / 1M
आउटपुट टोकन 1,596 3,972
रीजनिंग टोकन 0 48,333
प्रतिक्रिया समय (औसत) 24.23s 2.21s
प्रतिक्रिया समय (अधिकतम) 109.46s 14.63s
प्रतिक्रिया समय (कुल) 436.17s 37.51s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 4.8 10.0 25.0% 0 36.12s 221 0
Mercury 2 6.9 9.9 50.0% 0 1.12s 2,546 2,609
कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 33.40s 246 0
Mercury 2 10.0 10.0 100.0% 0 1.53s 249 2,213
संयुक्त स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 9.5 10.0 100.0% 0 34.55s 826 0
Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
डेटा पार्सिंग और निष्कर्षण स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 54.04s 65 0
Mercury 2 7.3 5.9 83.3% 1 1.11s 183 1,656
डोमेन-विशिष्ट स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 5.3 10.0 33.3% 0 3.74s 6 0
Mercury 2 2.9 7.2 11.1% 1 6.48s 41 30,754
Samanya Buddhimatta स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 4.5 10.0 0.0% 0 6.06s 45 0
Mercury 2 4.8 10.0 0.0% 0 821ms 137 542
निर्देश पालन स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 6.5 10.0 50.0% 0 3.57s 22 0
Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
पहेली समाधान स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 6.0 7.1 44.4% 1 28.25s 92 0
Mercury 2 3.9 7.5 22.2% 1 934ms 354 2,758
टूल कॉलिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) आउटपुट टोकन रीजनिंग टोकन
DeepSeek V4 Pro 10.0 10.0 100.0% 0 6.47s 73 0
Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956

त्वरित तुलना

तुलना जोड़ी बदलें