نیویگیشن
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs xAI: Grok 4.20

خلاصہ

Gemini 3.1 Flash Lite vs Grok 4.20 benchmark موازنہ: Gemini 3.1 Flash Lite average score میں آگے ہے: 6.1 vs 5.3. Gemini 3.1 Flash Lite کی benchmark لاگت کم ہے: $0.013 vs $0.057. Grok 4.20 تیز ہے: 1.11s vs 1.33s، pass rates 54.0% vs 33.3%.

تجویز کردہ ماڈل: Gemini 3.1 Flash Lite - It has the best score here (6.1), while costing about 4.4x less than Grok 4.20.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal اجرا: 2026-05-08 Grok 4.20 Grok 4.20 none اجرا: 2026-03-31
اسکور 6.1 5.3
درجہ #95 #130
اعتماد پذیری 10.0 دستیاب نہیں
تسلسل 8.8 10.0
درست ٹیسٹس
فی کوشش کامیابی کی شرح 54.0% 33.3%
غیر مستحکم ٹیسٹ 3 0
کل رنز 63 54
فی نتیجہ لاگت 0.130 1.570
کل لاگت $0.013 $0.057
ان پٹ قیمت $0.250 / 1M $1.250 / 1M
آؤٹ پٹ قیمت $1.500 / 1M $2.500 / 1M
کل ان پٹ ٹوکنز 36,973 41,313
آؤٹ پٹ ٹوکنز 2,487 1,923
ریزننگ ٹوکنز 0 0
ردِعمل کا وقت (اوسط) 1.33s 1.11s
ردِعمل کا وقت (زیادہ سے زیادہ) 4.49s 6.04s
ردِعمل کا وقت (کل) 27.91s 19.96s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#95 Gemini 3.1 Flash Lite

minimal
Cost
$0.001
Time
3.7s
Tokens
635 tok

#130 xAI: Grok 4.20

none
Cost
$0.004
Time
6.5s
Tokens
1,367 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 8.3 10.0 75.0% 0 1.10s 500 639 0
Grok 4.20 4.8 10.0 25.0% 0 501ms 1,986 267 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 831ms 8,126 666 0
Grok 4.20 3.4 9.3 0.0% 0 1.22s 1,074 312 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 2.53s 12,870 357 0
Grok 4.20 3.0 10.0 0.0% 0 6.04s 17,673 282 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.04s 7,552 279 0
Grok 4.20 10.0 10.0 100.0% 0 522ms 7,749 207 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 1.02s 641 15 0
Grok 4.20 3.0 10.0 0.0% 0 687ms 1,746 325 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 791ms 490 63 0
Grok 4.20 4.8 10.0 0.0% 0 659ms 819 83 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 932ms 615 72 0
Grok 4.20 6.3 10.0 50.0% 0 445ms 1,350 60 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 6.0 4.6 66.7% 2 2.15s 564 153 0
Grok 4.20 5.3 10.0 33.3% 0 473ms 1,671 198 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 3.51s 5,457 234 0
Grok 4.20 10.0 10.0 100.0% 0 4.63s 7,245 189 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 724ms 158 9 0
Grok 4.20 - - - - - - - - -

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں