نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Inception: Mercury 2

خلاصہ

DeepSeek V4 Pro vs Mercury 2 benchmark موازنہ: Mercury 2 average score میں آگے ہے: 6.6 vs 5.7. DeepSeek V4 Pro کی benchmark لاگت کم ہے: $0.025 vs $0.058. Mercury 2 تیز ہے: 2.24s vs 12.38s، pass rates 42.9% vs 54.0%.

تجویز کردہ ماڈل: Mercury 2 - It has the best score here (6.6), while responding about 5.5x faster than DeepSeek V4 Pro.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-04

میٹرک DeepSeek V4 Pro DeepSeek V4 Pro none اجرا: 2026-04-24 Mercury 2 Mercury 2 medium اجرا: 2026-02-24
اسکور 5.7 6.6
درجہ #113 #81
اعتماد پذیری 8.5 10.0
تسلسل 8.5 8.8
درست ٹیسٹس
فی کوشش کامیابی کی شرح 42.9% 54.0%
غیر مستحکم ٹیسٹ 4 3
کل رنز 63 63
فی نتیجہ لاگت 0.660 0.578
کل لاگت $0.025 $0.058
ان پٹ قیمت $0.435 / 1M $0.250 / 1M
آؤٹ پٹ قیمت $0.870 / 1M $0.750 / 1M
کل ان پٹ ٹوکنز 44,845 35,116
آؤٹ پٹ ٹوکنز 5,349 4,048
ریزننگ ٹوکنز 0 61,219
ردِعمل کا وقت (اوسط) 12.38s 2.24s
ردِعمل کا وقت (زیادہ سے زیادہ) 58.65s 14.63s
ردِعمل کا وقت (کل) 260.06s 44.72s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#113 DeepSeek V4 Pro

none
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

#81 Mercury 2

medium
Cost
$0.002
Time
2.1s
Tokens
1,702 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 3.5 8.0 16.7% 1 14.02s 540 704 0
Mercury 2 6.9 9.9 50.0% 0 1.12s 554 2,546 2,609
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 4.6 7.9 22.2% 1 6.11s 7,279 531 0
Mercury 2 8.2 7.7 77.8% 1 2.04s 7,065 296 11,328
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 9.5 10.0 100.0% 0 25.49s 20,773 1,911 0
Mercury 2 10.0 10.0 100.0% 0 3.28s 12,909 268 4,887
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 6.9 5.8 66.7% 1 30.54s 5,633 170 0
Mercury 2 7.3 5.9 83.3% 1 1.11s 6,234 183 1,656
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 5.3 10.0 33.3% 0 3.17s 666 18 0
Mercury 2 2.9 7.2 11.1% 1 6.48s 695 41 30,754
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 4.3 9.9 0.0% 0 3.75s 471 132 0
Mercury 2 4.8 10.0 0.0% 0 821ms 456 137 542
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 6.3 10.0 50.0% 0 8.23s 627 64 0
Mercury 2 10.0 10.0 100.0% 0 1.07s 340 14 958
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 7.6 7.2 77.8% 1 15.95s 594 173 0
Mercury 2 5.4 10.0 33.3% 0 949ms 601 361 2,781
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 10.0 10.0 100.0% 0 5.92s 8,079 219 0
Mercury 2 10.0 10.0 100.0% 0 1.89s 6,080 180 1,956
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 3.0 10.0 0.0% 0 15.59s 183 1,427 0
Mercury 2 3.0 10.0 0.0% 0 2.58s 182 22 3,748

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں