نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs xAI: Grok 4.3

خلاصہ

Gemini 3 Flash Preview vs Grok 4.3 benchmark موازنہ: Grok 4.3 average score میں آگے ہے: 7.7 vs 6.9. Gemini 3 Flash Preview کی benchmark لاگت کم ہے: $0.025 vs $0.614. Gemini 3 Flash Preview تیز ہے: 1.65s vs 47.51s، pass rates 66.7% vs 71.4%.

تجویز کردہ ماڈل: Gemini 3 Flash Preview - It offers the best overall trade-off: a competitive score (6.9), lower cost than Grok 4.3, and balanced response time.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Gemini 3 Flash Preview Gemini 3 Flash Preview none اجرا: 2025-12-17 Grok 4.3 Grok 4.3 medium اجرا: 2026-05-01
اسکور 6.9 7.7
درجہ #68 #40
اعتماد پذیری 10.0 10.0
تسلسل 9.2 8.5
درست ٹیسٹس
فی کوشش کامیابی کی شرح 66.7% 71.4%
غیر مستحکم ٹیسٹ 2 4
کل رنز 63 63
فی نتیجہ لاگت 0.186 4.724
کل لاگت $0.025 $0.614
ان پٹ قیمت $0.500 / 1M $1.250 / 1M
آؤٹ پٹ قیمت $3.000 / 1M $2.500 / 1M
کل ان پٹ ٹوکنز 37,011 44,472
آؤٹ پٹ ٹوکنز 1,885 1,981
ریزننگ ٹوکنز 0 221,382
ردِعمل کا وقت (اوسط) 1.65s 47.51s
ردِعمل کا وقت (زیادہ سے زیادہ) 3.56s 216.69s
ردِعمل کا وقت (کل) 23.07s 997.68s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#68 Gemini 3 Flash Preview

none
Cost
$0.003
Time
5.6s
Tokens
981 tok

#40 xAI: Grok 4.3

medium
Cost
$0.009
Time
19.0s
Tokens
3,661 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 8.3 10.0 75.0% 0 1.25s 498 214 0
Grok 4.3 10.0 10.0 100.0% 0 8.83s 2,010 88 8,207
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 5.5 10.0 33.3% 0 1.80s 8,122 453 0
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 4.7 1.6 66.7% 1 3.56s 12,862 350 0
Grok 4.3 10.0 10.0 100.0% 0 63.99s 12,909 234 15,301
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.41s 7,263 279 0
Grok 4.3 10.0 10.0 100.0% 0 18.97s 7,761 180 9,546
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 963ms 643 18 0
Grok 4.3 5.3 7.2 44.4% 1 181.74s 1,764 14 111,300
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 1.13s 490 104 0
Grok 4.3 5.4 2.5 66.7% 1 24.70s 825 70 5,020
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 6.4 5.8 66.7% 1 1.58s 619 74 0
Grok 4.3 9.8 10.0 100.0% 0 18.58s 1,362 57 8,713
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 7.7 10.0 66.7% 0 1.05s 574 144 0
Grok 4.3 5.9 7.2 55.6% 1 22.52s 1,689 128 14,468
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.35s 5,784 234 0
Grok 4.3 10.0 10.0 100.0% 0 17.66s 7,263 168 4,615
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 3.0 10.0 0.0% 0 1.07s 156 15 0
Grok 4.3 3.0 10.0 0.0% 0 44.47s 549 14 12,986

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں