نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs OpenAI: GPT-4o-mini

خلاصہ

Gemini 3 Flash Preview vs GPT-4o-mini benchmark موازنہ: Gemini 3 Flash Preview average score میں آگے ہے: 9.6 vs 5.0. GPT-4o-mini کی benchmark لاگت کم ہے: $0.006 vs $0.667. GPT-4o-mini تیز ہے: 1.77s vs 18.64s، pass rates 98.4% vs 23.8%.

تجویز کردہ ماڈل: Gemini 3 Flash Preview - It has the strongest score in this comparison (9.6) and the best overall balance of cost and response time across all 2 models.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-07-02

میٹرک Gemini 3 Flash Preview Gemini 3 Flash Preview medium اجرا: 2025-12-17 GPT-4o-mini GPT-4o-mini none اجرا: 2024-07-18
اسکور 9.6 5.0
درجہ #2 #144
اعتماد پذیری 10.0 10.0
تسلسل 9.7 9.9
درست ٹیسٹس
فی کوشش کامیابی کی شرح 98.4% 23.8%
غیر مستحکم ٹیسٹ 1 0
کل رنز 63 63
فی نتیجہ لاگت 3.335 0.119
کل لاگت $0.667 $0.006
ان پٹ قیمت $0.500 / 1M $0.150 / 1M
آؤٹ پٹ قیمت $3.000 / 1M $0.600 / 1M
کل ان پٹ ٹوکنز 37,017 31,518
آؤٹ پٹ ٹوکنز 2,006 1,982
ریزننگ ٹوکنز 214,153 0
ردِعمل کا وقت (اوسط) 18.64s 1.77s
ردِعمل کا وقت (زیادہ سے زیادہ) 117.26s 7.58s
ردِعمل کا وقت (کل) 391.35s 24.80s

جنریشن شوکیس

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#2 Gemini 3 Flash Preview

medium
لاگت
$0.010
وقت
17.9s
ٹوکنز
3,236 tok

#144 GPT-4o-mini

none
لاگت
$0.001
وقت
6.6s
ٹوکنز
742 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.88s 494 330 3,216
GPT-4o-mini 4.8 10.0 25.0% 0 1.34s 618 186 0
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 8.6 7.6 88.9% 1 84.40s 8,122 462 161,084
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 22.42s 12,873 351 10,485
GPT-4o-mini 3.0 10.0 0.0% 0 7.58s 8,298 568 0
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.43s 7,548 279 4,893
GPT-4o-mini 10.0 10.0 100.0% 0 1.27s 7,161 183 0
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 15.27s 633 12 21,684
GPT-4o-mini 3.0 10.0 0.0% 0 637ms 732 15 0
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.19s 486 72 1,905
GPT-4o-mini 4.0 10.0 0.0% 0 909ms 480 66 0
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.04s 615 72 2,709
GPT-4o-mini 6.3 10.0 50.0% 0 1.11s 666 69 0
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.05s 558 183 4,365
GPT-4o-mini 3.5 10.0 0.0% 0 1.21s 651 308 0
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 12.60s 5,532 234 1,487
GPT-4o-mini 10.0 10.0 100.0% 0 2.51s 5,400 205 0
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.50s 156 11 2,325
GPT-4o-mini 3.0 10.0 0.0% 0 794ms 198 15 0

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں