नेव्हिगेशन
AI BENCHY
Advertise here

DeepSeek V3.2 (medium) vs Mercury 2 (medium)

average score जवळपास समान आहे: 7.0 vs 7.0. DeepSeek V3.2 (medium) चा benchmark खर्च कमी आहे: $0.078 vs $0.094. Mercury 2 (medium) वेगवान आहे: 2.95s vs 68.43s, pass rates 65.2% vs 53.0%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-02

क्रमांक
#128
एकूण आउटपुट टोकन्स
128,787
प्रतिसाद वेळ (सरासरी)
68.43s
एकूण खर्च
$0.078
क्रमांक
#131
एकूण आउटपुट टोकन्स
87,554
प्रतिसाद वेळ (सरासरी)
2.95s
एकूण खर्च
$0.094
शिफारस केलेले मॉडेल Mercury 2 (medium)

It has the best score here (7.0), while responding about 23.2x faster than DeepSeek V3.2 (medium).

तपशीलवार तुलना

मेट्रिक DeepSeek V3.2 DeepSeek V3.2 medium प्रकाशन: 2025-12-01 Mercury 2 Mercury 2 medium प्रकाशन: 2026-02-24
स्कोअर 7.0 7.0
क्रमांक #128 #131
विश्वसनीयता 10.0 10.0
सुसंगतता 7.4 8.4
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 53.0%
अस्थिर चाचण्या 7 4
एकूण रन 66 66
प्रति निकाल खर्च 0.672 0.933
एकूण खर्च $0.078 $0.094
इनपुट किंमत $0.269 / 1M $0.250 / 1M
आउटपुट किंमत $0.400 / 1M $0.750 / 1M
एकूण इनपुट टोकन्स 101,056 110,515
आउटपुट टोकन्स 11,832 10,325
रिझनिंग टोकन्स 116,955 77,229
प्रतिसाद वेळ (सरासरी) 68.43s 2.95s
प्रतिसाद वेळ (कमाल) 376.10s 14.63s
प्रतिसाद वेळ (एकूण) 1505.53s 61.89s
पॅरामीटर्स 671B एकूण (37B सक्रिय) ~100B
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#128 DeepSeek V3.2

medium
खर्च
$0.001
वेळ
53.6s
टोकन्स
1,932 tok

#131 Mercury 2

medium
खर्च
$0.002
वेळ
2.1s
टोकन्स
1,702 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
Mercury 2 8.2 7.7 77.8% 1 2.04s 7,065 296 11,328

झटपट तुलना

तुलना जोडी बदला