नेव्हिगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek: DeepSeek V4 Pro vs Inception: Mercury 2

Mercury 2 (medium) average score मध्ये पुढे आहे: 7.0 vs 6.9. Mercury 2 (medium) चा benchmark खर्च कमी आहे: $0.093 vs $0.096. Mercury 2 (medium) वेगवान आहे: 2.72s vs 11.55s, pass rates 51.5% vs 51.5%.

शिफारस केलेले मॉडेलMercury 2 (medium)It has the best score here (7.0), while responding about 4.2x faster than DeepSeek V4 Pro.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-07-22

मेट्रिक DeepSeek V4 Pro DeepSeek V4 Pro none प्रकाशन: 2026-04-24 Mercury 2 Mercury 2 medium प्रकाशन: 2026-02-24
स्कोअर 6.9 7.0
क्रमांक #86 #82
विश्वसनीयता 10.0 10.0
सुसंगतता 8.6 8.8
बरोबर चाचण्या
प्रति प्रयत्न पास दर 51.5% 51.5%
अस्थिर चाचण्या 4 3
एकूण रन 66 66
प्रति निकाल खर्च 0.954 0.928
एकूण खर्च $0.096 $0.093
इनपुट किंमत $0.435 / 1M $0.250 / 1M
आउटपुट किंमत $0.870 / 1M $0.750 / 1M
एकूण इनपुट टोकन्स 148,069 109,572
आउटपुट टोकन्स 35,551 10,313
रिझनिंग टोकन्स 0 76,806
प्रतिसाद वेळ (सरासरी) 11.55s 2.72s
प्रतिसाद वेळ (कमाल) 119.44s 14.63s
प्रतिसाद वेळ (एकूण) 254.11s 57.12s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#86 DeepSeek V4 Pro

none
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

#82 Mercury 2

medium
खर्च
$0.002
वेळ
2.1s
टोकन्स
1,702 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V4 Pro 5.6 10.0 33.3% 0 13.38s 7,275 5,500 0
Mercury 2 8.2 7.7 77.8% 1 2.04s 7,065 296 11,328

झटपट तुलना

तुलना जोडी बदला