DeepSeek: DeepSeek V3.2 vs Inception: Mercury 2

average score लगभग बराबर है: 7.0 vs 7.0. DeepSeek V3.2 (medium) की benchmark लागत कम है: $0.078 vs $0.093. Mercury 2 (medium) तेज है: 2.72s vs 68.62s, pass rates 65.2% vs 51.5%.

अनुशंसित मॉडलMercury 2 (medium)It has the best score here (7.0), while responding about 25.2x faster than DeepSeek V3.2 (medium).

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-18

मेट्रिक	DeepSeek V3.2 DeepSeek V3.2 medium रिलीज़: 2025-12-01	Mercury 2 Mercury 2 medium रिलीज़: 2026-02-24

मेट्रिक	DeepSeek V3.2 DeepSeek V3.2 medium रिलीज़: 2025-12-01	Mercury 2 Mercury 2 medium रिलीज़: 2026-02-24
स्कोर	7.0	7.0
रैंक	#75	#77
विश्वसनीयता	10.0	10.0
संगति	7.4	8.8
सही परीक्षण
प्रति प्रयास पास दर	65.2%	51.5%
अस्थिर टेस्ट	7	3
कुल रन	66	66
प्रति परिणाम लागत	0.671	0.928
कुल लागत	$0.078	$0.093
इनपुट कीमत	$0.269 / 1M	$0.250 / 1M
आउटपुट कीमत	$0.400 / 1M	$0.750 / 1M
कुल इनपुट टोकन	101,047	109,572
आउटपुट टोकन	11,834	10,313
रीजनिंग टोकन	117,014	76,806
प्रतिक्रिया समय (औसत)	68.62s	2.72s
प्रतिक्रिया समय (अधिकतम)	376.10s	14.63s
प्रतिक्रिया समय (कुल)	1509.53s	57.12s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#75 DeepSeek V3.2

medium

लागत: $0.001
समय: 53.6s
टोकन: 1,932 tok

#77 Mercury 2

medium

लागत: $0.002
समय: 2.1s
टोकन: 1,702 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

श्रेणी:

एंटी-एआई ट्रिक्स	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	8.2	7.9	83.3%	1		24.23s	448	3,247	6,953
Mercury 2	6.9	9.9	50.0%	0		1.12s	554	2,546	2,609

कोडिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	6.0	7.2	55.6%	1		248.68s	5,717	649	52,014
Mercury 2	8.2	7.7	77.8%	1		2.04s	7,065	296	11,328

संयुक्त	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	7.3	5.8	83.3%	1		79.92s	76,997	5,219	24,229
Mercury 2	6.7	9.1	50.0%	0		7.84s	87,365	6,533	20,474

डेटा पार्सिंग और निष्कर्षण	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	10.0	10.0	100.0%	0		36.09s	7,388	207	7,693
Mercury 2	7.3	5.9	83.3%	1		1.11s	6,234	183	1,656

डोमेन-विशिष्ट	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	2.9	4.4	22.2%	2		24.27s	472	21	6,838
Mercury 2	2.9	7.2	11.1%	1		6.48s	695	41	30,754

Samanya Buddhimatta	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	3.4	2.5	33.3%	1		58.29s	314	49	2,189
Mercury 2	4.8	10.0	0.0%	0		821ms	456	137	542

निर्देश पालन	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	10.0	10.0	100.0%	0		35.78s	627	1,397	2,845
Mercury 2	10.0	10.0	100.0%	0		1.07s	340	14	958

पहेली समाधान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	7.0	7.2	55.6%	1		37.69s	594	518	6,375
Mercury 2	5.4	10.0	33.3%	0		949ms	601	361	2,781

टूल कॉलिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	10.0	10.0	100.0%	0		34.81s	8,307	507	859
Mercury 2	10.0	10.0	100.0%	0		1.89s	6,080	180	1,956

सामान्य ज्ञान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
DeepSeek V3.2	3.0	10.0	0.0%	0		83.99s	183	20	7,019
Mercury 2	3.0	10.0	0.0%	0		2.58s	182	22	3,748

त्वरित तुलना

तुलना जोड़ी बदलें

Gemini 3.5 FlashnonevsMercury 2medium DeepSeek V3.2mediumvsGemini 3.5 Flashnone DeepSeek V4 PrononevsMercury 2medium Mercury 2mediumvsGPT-5.6 Solnone DeepSeek V3.2mediumvsGPT-5.6 Solnone Mercury 2mediumvsStep 3.7 Flashhigh Mercury 2mediumvsGPT-5.5none DeepSeek V3.2mediumvsQwen3.7 Plusnone DeepSeek V3.2mediumvsStep 3.7 Flashhigh DeepSeek V3.2mediumvsGPT-5.5none Mercury 2mediumvsQwen3.7 Plusnone Gemini 3.5 FlashminimalvsMercury 2medium