نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Pro Preview vs xAI: Grok 4.20 Beta

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-03-12

میٹرک Gemini 3.1 Pro Preview Gemini 3.1 Pro Preview medium اجرا: 2026-02-19 Grok 4.20 Beta Grok 4.20 Beta none اجرا: 2026-03-12
درجہ #2 #52
اوسط اسکور 9.4 4.4
تسلسل 10.0 9.1
فی نتیجہ لاگت 3.417 2.214
کل لاگت $0.513 $0.089
درست ٹیسٹس
فی کوشش کامیابی کی شرح 93.8% 33.3%
غیر مستحکم ٹیسٹ 0 2
کل رنز 48 48
آؤٹ پٹ ٹوکنز 1,521 1,511
ریزننگ ٹوکنز 35,656 0
ردِعمل کا وقت (اوسط) 16.60s 1.22s
ردِعمل کا وقت (زیادہ سے زیادہ) 40.61s 6.48s
ردِعمل کا وقت (کل) 149.36s 19.53s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اوسط اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اوسط اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 9.52s 106 2,533
Grok 4.20 Beta 3.3 7.9 22.2% 1 562ms 245 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Pro Preview 9.0 10.0 100.0% 0 40.61s 432 9,281
Grok 4.20 Beta 10.0 10.0 0.0% 0 6.48s 282 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Pro Preview 9.9 10.0 100.0% 0 7.72s 279 3,904
Grok 4.20 Beta 9.9 10.0 100.0% 0 601ms 197 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Pro Preview 7.0 10.0 66.7% 0 32.73s 18 12,424
Grok 4.20 Beta 10.0 10.0 0.0% 0 611ms 160 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 11.77s 108 1,179
Grok 4.20 Beta 5.0 10.0 0.0% 0 541ms 87 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 9.56s 72 2,236
Grok 4.20 Beta 4.5 10.0 0.0% 0 687ms 60 0
Puzzle Solving اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 7.15s 232 3,117
Grok 4.20 Beta 4.0 7.2 55.6% 1 541ms 291 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Pro Preview 10.0 10.0 100.0% 0 23.15s 274 982
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.79s 189 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں