نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs xAI: Grok 4.3

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-05-08

میٹرک Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low اجرا: 2026-05-08 Grok 4.3 Grok 4.3 medium اجرا: 2026-05-01
اسکور 7.6 8.0
درجہ #44 #24
اعتماد پذیری 10.0 10.0
تسلسل 9.2 8.7
درست ٹیسٹس
فی کوشش کامیابی کی شرح 68.4% 77.2%
غیر مستحکم ٹیسٹ 2 3
کل رنز 57 57
فی نتیجہ لاگت 0.203 4.229
کل لاگت $0.025 $0.550
?? ?? ???? $0.250 / 1M $1.250 / 1M
??? ?? ???? $1.500 / 1M $2.500 / 1M
آؤٹ پٹ ٹوکنز 2,702 1,237
ریزننگ ٹوکنز 8,596 200,033
ردِعمل کا وقت (اوسط) 1.92s 48.41s
ردِعمل کا وقت (زیادہ سے زیادہ) 5.66s 216.69s
ردِعمل کا وقت (کل) 36.49s 919.73s

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 7.3 6.2 75.0% 2 1.84s 1,013 1,548
Grok 4.3 10.0 10.0 100.0% 0 8.83s 88 8,207
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.46s 441 408
Grok 4.3 10.0 10.0 100.0% 0 45.72s 284 9,659
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 4.48s 348 975
Grok 4.3 10.0 10.0 100.0% 0 63.99s 234 15,301
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.44s 291 697
Grok 4.3 10.0 10.0 100.0% 0 18.97s 180 9,546
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 5.3 10.0 33.3% 0 1.52s 15 1,214
Grok 4.3 5.3 7.2 44.4% 1 181.74s 14 111,300
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 1.37s 69 438
Grok 4.3 5.4 2.5 66.7% 1 24.70s 70 5,020
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.52s 72 760
Grok 4.3 9.8 10.0 100.0% 0 18.58s 57 8,713
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.40s 210 1,191
Grok 4.3 5.9 7.2 55.6% 1 22.53s 128 14,686
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 5.66s 234 945
Grok 4.3 10.0 10.0 100.0% 0 17.66s 168 4,615
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 1.46s 9 420
Grok 4.3 3.0 10.0 0.0% 0 44.47s 14 12,986

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں