নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs Inception: Mercury 2

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-05-08

মেট্রিক Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite none প্রকাশ: 2026-05-08 Mercury 2 Mercury 2 medium প্রকাশ: 2026-02-24
স্কোর 6.7 6.3
র‍্যাঙ্ক #73 #80
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.4 8.7
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 57.9% 50.9%
অস্থির টেস্ট 4 3
মোট রান 57 57
প্রতি ফলাফলে খরচ 0.123 0.616
মোট খরচ $0.012 $0.050
???? ??? $0.250 / 1M $0.250 / 1M
????? ??? $1.500 / 1M $0.750 / 1M
আউটপুট টোকেন 2,454 3,994
রিজনিং টোকেন 0 52,081
প্রতিক্রিয়া সময় (গড়) 1.11s 2.23s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 2.97s 14.63s
প্রতিক্রিয়া সময় (মোট) 21.13s 40.10s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 7.5 8.4 66.7% 1 1.07s 639 0
Mercury 2 6.9 9.9 50.0% 0 1.12s 2,546 2,609
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.59s 636 0
Mercury 2 10.0 10.0 100.0% 0 1.53s 249 2,213
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 2.73s 357 0
Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 843ms 279 0
Mercury 2 7.3 5.9 83.3% 1 1.11s 183 1,656
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 762ms 15 0
Mercury 2 2.9 7.2 11.1% 1 6.48s 41 30,754
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 992ms 63 0
Mercury 2 4.8 10.0 0.0% 0 821ms 137 542
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 859ms 72 0
Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 6.3 4.8 66.7% 2 720ms 150 0
Mercury 2 3.8 7.3 22.2% 1 934ms 354 2,758
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 2.97s 234 0
Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 733ms 9 0
Mercury 2 3.0 10.0 0.0% 0 2.58s 22 3,748

দ্রুত তুলনা

তুলনার জুটি বদলান