नेविगेशन
AI BENCHY
Advertise here

DeepSeek V3.2 (medium) vs Mercury 2 (medium)

average score लगभग बराबर है: 7.0 vs 7.0. DeepSeek V3.2 (medium) की benchmark लागत कम है: $0.078 vs $0.094. Mercury 2 (medium) तेज है: 2.95s vs 68.43s, pass rates 65.2% vs 53.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#128
कुल आउटपुट टोकन
128,787
प्रतिक्रिया समय (औसत)
68.43s
कुल लागत
$0.078
रैंक
#131
कुल आउटपुट टोकन
87,554
प्रतिक्रिया समय (औसत)
2.95s
कुल लागत
$0.094
अनुशंसित मॉडल Mercury 2 (medium)

It has the best score here (7.0), while responding about 23.2x faster than DeepSeek V3.2 (medium).

विस्तृत तुलना

मेट्रिक DeepSeek V3.2 DeepSeek V3.2 medium रिलीज़: 2025-12-01 Mercury 2 Mercury 2 medium रिलीज़: 2026-02-24
स्कोर 7.0 7.0
रैंक #128 #131
विश्वसनीयता 10.0 10.0
संगति 7.4 8.4
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 53.0%
अस्थिर टेस्ट 7 4
कुल रन 66 66
प्रति परिणाम लागत 0.672 0.933
कुल लागत $0.078 $0.094
इनपुट कीमत $0.269 / 1M $0.250 / 1M
आउटपुट कीमत $0.400 / 1M $0.750 / 1M
कुल इनपुट टोकन 101,056 110,515
आउटपुट टोकन 11,832 10,325
रीजनिंग टोकन 116,955 77,229
प्रतिक्रिया समय (औसत) 68.43s 2.95s
प्रतिक्रिया समय (अधिकतम) 376.10s 14.63s
प्रतिक्रिया समय (कुल) 1505.53s 61.89s
पैरामीटर 671B कुल (37B सक्रिय) ~100B
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#128 DeepSeek V3.2

medium
लागत
$0.001
समय
53.6s
टोकन
1,932 tok

#131 Mercury 2

medium
लागत
$0.002
समय
2.1s
टोकन
1,702 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
Mercury 2 8.2 7.7 77.8% 1 2.04s 7,065 296 11,328

त्वरित तुलना

तुलना जोड़ी बदलें