نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs xAI: Grok 4.20

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-05-10

میٹرک DeepSeek V3.2 DeepSeek V3.2 medium اجرا: 2025-12-01 Grok 4.20 Grok 4.20 medium اجرا: 2026-03-31
اسکور 7.2 6.9
درجہ #61 #68
اعتماد پذیری 10.0 10.0
تسلسل 7.5 8.3
درست ٹیسٹس
فی کوشش کامیابی کی شرح 72.8% 63.2%
غیر مستحکم ٹیسٹ 6 4
کل رنز 57 57
فی نتیجہ لاگت 0.278 7.559
کل لاگت $0.031 $0.756
?? ?? ???? $0.252 / 1M $1.250 / 1M
??? ?? ???? $0.378 / 1M $2.500 / 1M
آؤٹ پٹ ٹوکنز 7,035 1,784
ریزننگ ٹوکنز 53,765 128,233
ردِعمل کا وقت (اوسط) 46.06s 14.53s
ردِعمل کا وقت (زیادہ سے زیادہ) 180.92s 63.48s
ردِعمل کا وقت (کل) 875.23s 276.06s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V3.2 9.2 10.0 100.0% 0 24.23s 3,247 6,953
Grok 4.20 8.2 7.9 83.3% 1 3.95s 287 8,312
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V3.2 4.7 1.6 66.7% 1 180.92s 626 6,792
Grok 4.20 4.3 1.1 66.7% 1 24.33s 250 12,804
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V3.2 10.0 10.0 100.0% 0 93.11s 571 6,296
Grok 4.20 10.0 10.0 100.0% 0 17.40s 232 9,556
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V3.2 10.0 10.0 100.0% 0 36.09s 207 7,693
Grok 4.20 10.0 10.0 100.0% 0 4.17s 180 5,333
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V3.2 2.9 4.4 22.2% 2 24.27s 21 6,838
Grok 4.20 5.3 10.0 33.3% 0 27.03s 375 49,339
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V3.2 3.8 2.5 50.0% 1 58.29s 49 2,189
Grok 4.20 3.9 2.6 33.3% 1 24.48s 65 6,440
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V3.2 10.0 10.0 100.0% 0 35.78s 1,397 2,845
Grok 4.20 7.3 6.0 83.3% 1 4.42s 40 5,474
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V3.2 6.7 5.0 66.7% 2 36.87s 390 6,281
Grok 4.20 7.7 10.0 66.7% 0 6.20s 149 7,913
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V3.2 10.0 10.0 100.0% 0 34.81s 507 859
Grok 4.20 3.0 10.0 0.0% 0 13.68s 197 6,620
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
DeepSeek V3.2 3.0 10.0 0.0% 0 83.99s 20 7,019
Grok 4.20 3.0 10.0 0.0% 0 63.48s 9 16,442

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں