نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Anthropic: Claude Sonnet 4.6 vs xAI: Grok Build 0.1

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-05-21

میٹرک Claude Sonnet 4.6 Claude Sonnet 4.6 none اجرا: 2026-02-17 Grok Build 0.1 Grok Build 0.1 medium اجرا: 2026-05-21
اسکور 7.2 7.8
درجہ #69 #41
اعتماد پذیری 10.0 10.0
تسلسل 9.6 8.9
درست ٹیسٹس
فی کوشش کامیابی کی شرح 61.4% 71.9%
غیر مستحکم ٹیسٹ 1 3
کل رنز 57 57
فی نتیجہ لاگت 2.441 4.064
کل لاگت $0.269 $0.488
?? ?? ???? $3.000 / 1M $1.000 / 1M
??? ?? ???? $15.000 / 1M $2.000 / 1M
آؤٹ پٹ ٹوکنز 7,864 1,947
ریزننگ ٹوکنز 0 223,372
ردِعمل کا وقت (اوسط) 4.96s 22.28s
ردِعمل کا وقت (زیادہ سے زیادہ) 23.84s 88.28s
ردِعمل کا وقت (کل) 59.50s 423.30s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 4.8 10.0 25.0% 0 2.94s 1,214 0
Grok Build 0.1 10.0 10.0 100.0% 0 5.46s 195 9,825
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.67s 523 0
Grok Build 0.1 7.3 3.7 66.7% 1 30.98s 354 17,734
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 9.5 10.0 100.0% 0 23.84s 3,766 0
Grok Build 0.1 10.0 10.0 100.0% 0 30.81s 231 18,779
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 3.43s 252 0
Grok Build 0.1 10.0 10.0 100.0% 0 7.76s 180 10,343
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 7.7 10.0 66.7% 0 3.54s 413 0
Grok Build 0.1 5.3 10.0 33.3% 0 77.75s 501 111,807
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 6.1 3.1 66.7% 1 2.56s 192 0
Grok Build 0.1 3.8 2.5 33.3% 1 10.14s 78 5,386
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 6.5 10.0 50.0% 0 1.96s 90 0
Grok Build 0.1 9.8 10.0 100.0% 0 9.62s 57 12,436
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 7.7 10.0 66.7% 0 2.92s 536 0
Grok Build 0.1 6.2 7.5 55.6% 1 8.67s 161 15,476
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 10.0 10.0 100.0% 0 4.11s 447 0
Grok Build 0.1 10.0 10.0 100.0% 0 9.40s 180 5,319
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Claude Sonnet 4.6 3.0 10.0 0.0% 0 4.67s 431 0
Grok Build 0.1 3.0 10.0 0.0% 0 26.07s 10 16,267

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں