نیویگیشن
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3 Flash Preview vs Inception: Mercury 2

خلاصہ

Gemini 3 Flash Preview vs Mercury 2 benchmark موازنہ: Mercury 2 average score میں آگے ہے: 7.5 vs 7.4. Mercury 2 کی benchmark لاگت کم ہے: $0.058 vs $0.111. Mercury 2 تیز ہے: 2.24s vs 5.76s، pass rates 79.4% vs 54.0%.

تجویز کردہ ماڈل: Gemini 3 Flash Preview - It has the best overall balance of score, reliability, cost, and response time in this comparison.

بینچ مارکس AI BENCHY ٹیسٹ سوئٹس سے اس وقت تیار کیے گئے: 2026-06-12

میٹرک Gemini 3 Flash Preview Gemini 3 Flash Preview low اجرا: 2025-12-17 Mercury 2 Mercury 2 medium اجرا: 2026-02-24
اسکور 7.4 7.5
درجہ #53 #46
اعتماد پذیری 10.0 10.0
تسلسل 9.2 8.8
درست ٹیسٹس
فی کوشش کامیابی کی شرح 79.4% 54.0%
غیر مستحکم ٹیسٹ 2 3
کل رنز 63 63
فی نتیجہ لاگت 0.689 0.578
کل لاگت $0.111 $0.058
ان پٹ قیمت $0.500 / 1M $0.250 / 1M
آؤٹ پٹ قیمت $3.000 / 1M $0.750 / 1M
کل ان پٹ ٹوکنز 36,769 35,116
آؤٹ پٹ ٹوکنز 2,076 4,048
ریزننگ ٹوکنز 28,518 61,219
ردِعمل کا وقت (اوسط) 5.76s 2.24s
ردِعمل کا وقت (زیادہ سے زیادہ) 14.72s 14.63s
ردِعمل کا وقت (کل) 120.93s 44.72s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#53 Gemini 3 Flash Preview

low
Cost
$0.007
Time
12.1s
Tokens
2,289 tok

#46 Mercury 2

medium
Cost
$0.002
Time
2.1s
Tokens
1,702 tok

اسکور کے لحاظ سے سرفہرست ماڈلز

اسکور بمقابلہ کل لاگت

ردِعمل کا وقت (اوسط)

اسکور vs ردِعمل کا وقت (اوسط)

کل آؤٹ پٹ ٹوکنز

اسکور vs کل آؤٹ پٹ ٹوکنز

زمرہ وار تفصیل

اینٹی اے آئی چالیں اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.48s 500 281 3,082
Mercury 2 6.9 9.9 50.0% 0 1.12s 554 2,546 2,609
کوڈنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 5.8 7.2 44.4% 1 6.00s 8,122 456 7,421
Mercury 2 8.2 7.7 77.8% 1 2.04s 7,065 296 11,328
مشترکہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 3.0 10.0 0.0% 0 3.27s 12,860 326 0
Mercury 2 10.0 10.0 100.0% 0 3.28s 12,909 268 4,887
ڈیٹا پارسنگ اور استخراج اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 9.40s 7,261 279 3,656
Mercury 2 7.3 5.9 83.3% 1 1.11s 6,234 183 1,656
ڈومین مخصوص اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 5.3 7.2 44.4% 1 8.05s 645 12 6,410
Mercury 2 2.9 7.2 11.1% 1 6.48s 695 41 30,754
عمومی ذہانت اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.68s 492 120 981
Mercury 2 4.8 10.0 0.0% 0 821ms 456 137 542
ہدایات کی پیروی اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 9.9 10.0 100.0% 0 7.02s 621 71 2,752
Mercury 2 10.0 10.0 100.0% 0 1.07s 340 14 958
پہیلی حل کرنا اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.77s 562 288 3,168
Mercury 2 5.4 10.0 33.3% 0 949ms 601 361 2,781
ٹول کالنگ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.99s 5,550 234 415
Mercury 2 10.0 10.0 100.0% 0 1.89s 6,080 180 1,956
معلومات عامہ اسکور تسلسل فی کوشش کامیابی کی شرح غیر مستحکم ٹیسٹ درست ٹیسٹس ردِعمل کا وقت (اوسط) ان پٹ ٹوکنز آؤٹ پٹ ٹوکنز ریزننگ ٹوکنز
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 2.75s 156 9 633
Mercury 2 3.0 10.0 0.0% 0 2.58s 182 22 3,748

فوری موازنہ

موازنہ کی جوڑی تبدیل کریں