নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 3.5 Flash vs Inception: Mercury 2

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-03

মেট্রিক Gemini 3.5 Flash Gemini 3.5 Flash low প্রকাশ: 2026-05-19 Mercury 2 Mercury 2 medium প্রকাশ: 2026-02-24
স্কোর 9.3 6.5
র‍্যাঙ্ক #3 #89
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 10.0 8.8
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 90.0% 51.7%
অস্থির টেস্ট 0 3
মোট রান 60 60
প্রতি ফলাফলে খরচ 1.582 0.611
মোট খরচ $0.285 $0.055
ইনপুট মূল্য $1.500 / 1M $0.250 / 1M
আউটপুট মূল্য $9.000 / 1M $0.750 / 1M
মোট ইনপুট টোকেন 33,935 32,570
আউটপুট টোকেন 2,027 4,022
রিজনিং টোকেন 23,938 58,405
প্রতিক্রিয়া সময় (গড়) 2.98s 2.27s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 6.44s 14.63s
প্রতিক্রিয়া সময় (মোট) 59.59s 43.20s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.52s 494 209 2,536
Mercury 2 6.9 9.9 50.0% 0 1.12s 554 2,546 2,609
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 6.8 10.0 50.0% 0 5.54s 5,115 452 6,839
Mercury 2 7.2 6.5 66.7% 1 2.29s 4,519 270 8,514
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 6.44s 12,873 351 3,050
Mercury 2 10.0 10.0 100.0% 0 3.28s 12,909 268 4,887
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.81s 7,548 279 1,164
Mercury 2 7.3 5.9 83.3% 1 1.11s 6,234 183 1,656
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 7.7 10.0 66.7% 0 3.39s 633 12 4,538
Mercury 2 2.9 7.2 11.1% 1 6.48s 695 41 30,754
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.27s 486 119 916
Mercury 2 4.8 10.0 0.0% 0 821ms 456 137 542
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 9.9 10.0 100.0% 0 1.86s 615 71 1,652
Mercury 2 10.0 10.0 100.0% 0 1.07s 340 14 958
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 2.35s 558 288 2,150
Mercury 2 5.4 10.0 33.3% 0 949ms 601 361 2,781
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 3.27s 5,457 234 403
Mercury 2 10.0 10.0 100.0% 0 1.89s 6,080 180 1,956
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash 10.0 10.0 100.0% 0 1.88s 156 12 690
Mercury 2 3.0 10.0 0.0% 0 2.58s 182 22 3,748

দ্রুত তুলনা

তুলনার জুটি বদলান