نیویگیشن
AI BENCHY
Advertise here

DeepSeek V3.2 (medium) vs Grok 4.20 (medium)

average score تقریباً برابر ہے: 7.0 vs 7.0. DeepSeek V3.2 (medium) کی benchmark لاگت کم ہے: $0.078 vs $0.805. Grok 4.20 (medium) تیز ہے: 32.56s vs 68.43s، pass rates 65.2% vs 60.6%.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-08-15

درجہ
#116
کل آؤٹ پٹ ٹوکنز
128,787
ردِعمل کا وقت (اوسط)
68.43s
کل لاگت
$0.078
درجہ
#120
کل آؤٹ پٹ ٹوکنز
270,259
ردِعمل کا وقت (اوسط)
32.56s
کل لاگت
$0.805
تجویز کردہ ماڈل DeepSeek V3.2 (medium)

It has the best score here (7.0), while costing about 10.4x less than Grok 4.20 (medium).

تفصیلی موازنہ

میٹرک DeepSeek V3.2 DeepSeek V3.2 medium اجرا: 2025-12-01 Grok 4.20 Grok 4.20 medium اجرا: 2026-03-31
اسکور 7.0 7.0
درجہ #116 #120
اعتماد پذیری 10.0 10.0
تسلسل 7.4 8.2
کوششیں 66/66 66/66
درست ٹیسٹس
فی کوشش کامیابی کی شرح 65.2% 60.6%
غیر مستحکم ٹیسٹ 7 5
کل رنز 66 66
فی نتیجہ لاگت 0.672 10.365
کل لاگت $0.078 $0.805
ان پٹ قیمت $0.269 / 1M $1.250 / 1M
آؤٹ پٹ قیمت $0.400 / 1M $2.500 / 1M
کل ان پٹ ٹوکنز 101,056 102,986
آؤٹ پٹ ٹوکنز 11,832 5,860
ریزننگ ٹوکنز 116,955 264,399
ردِعمل کا وقت (اوسط) 68.43s 32.56s
ردِعمل کا وقت (زیادہ سے زیادہ) 376.10s 199.66s
ردِعمل کا وقت (کل) 1505.53s 716.36s
پیرامیٹرز 671B کل (37B فعال) ~1T کل (~100B فعال)
دستیابی کھلا ماخذ بند ماخذ

ماڈل جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#116 DeepSeek V3.2

medium
لاگت
$0.001
وقت
53.6s
ٹوکنز
1,932 tok

#120 SpaceXAI: Grok 4.20

medium
لاگت
$0.041
وقت
110.3s
ٹوکنز
16,336 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں