نیویگیشن
AI BENCHY
Advertise here

DeepSeek V4 Pro (high) vs Grok Build 0.1 (medium)

DeepSeek V4 Pro (high) average score میں آگے ہے: 7.7 vs 7.6. DeepSeek V4 Pro (high) کی benchmark لاگت کم ہے: $0.200 vs $1.097. Grok Build 0.1 (medium) تیز ہے: 52.06s vs 79.14s، pass rates 63.6% vs 63.6%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-01

درجہ
#58
کل آؤٹ پٹ ٹوکنز
189,181
ردِعمل کا وقت (اوسط)
79.14s
کل لاگت
$0.200
درجہ
#60
کل آؤٹ پٹ ٹوکنز
494,663
ردِعمل کا وقت (اوسط)
52.06s
کل لاگت
$1.097
تجویز کردہ ماڈل DeepSeek V4 Pro (high)

It has the best score here (7.7), while costing about 5.5x less than Grok Build 0.1 (medium).

تفصیلی موازنہ

میٹرک DeepSeek V4 Pro DeepSeek V4 Pro high اجرا: 2026-04-24 Grok Build 0.1 Grok Build 0.1 medium اجرا: 2026-05-21
اسکور 7.7 7.6
درجہ #58 #60
اعتماد پذیری 10.0 10.0
تسلسل 7.7 10.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 63.6% 63.6%
غیر مستحکم ٹیسٹ 6 0
کل رنز 66 66
فی نتیجہ لاگت 2.000 7.830
کل لاگت $0.200 $1.097
ان پٹ قیمت $0.435 / 1M $1.000 / 1M
آؤٹ پٹ قیمت $0.870 / 1M $2.000 / 1M
کل ان پٹ ٹوکنز 90,748 106,751
آؤٹ پٹ ٹوکنز 10,462 7,993
ریزننگ ٹوکنز 178,719 486,670
ردِعمل کا وقت (اوسط) 79.14s 52.06s
ردِعمل کا وقت (زیادہ سے زیادہ) 416.76s 252.69s
ردِعمل کا وقت (کل) 1740.97s 1145.27s

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#58 DeepSeek V4 Pro

high
لاگت
$0.023
وقت
257.6s
ٹوکنز
14,870 tok

#60 xAI: Grok Build 0.1

medium
لاگت
$0.028
وقت
81.3s
ٹوکنز
14,009 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V4 Pro 6.3 8.7 33.3% 0 243.00s 5,090 383 84,580
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں