নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Google: Gemini 3.5 Flash-Lite vs xAI: Grok 4.5

Grok 4.5 (low) average score-এ এগিয়ে: 8.4 vs 8.1. Gemini 3.5 Flash-Lite (high)-এর benchmark খরচ কম: $0.584 vs $0.935. Gemini 3.5 Flash-Lite (high) দ্রুত: 9.48s vs 15.56s, pass rates 81.8% vs 75.8%.

প্রস্তাবিত মডেলGemini 3.5 Flash-Lite (high)Its score stays close to the best score here (8.1 vs 8.4), while costing about 1.6x less than Grok 4.5 (low).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-21

মেট্রিক Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite high প্রকাশ: 2026-07-21 Grok 4.5 Grok 4.5 low প্রকাশ: 2026-07-08
স্কোর 8.1 8.4
র‍্যাঙ্ক #31 #23
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.5 9.7
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 81.8% 75.8%
অস্থির টেস্ট 7 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.169 5.844
মোট খরচ $0.584 $0.935
ইনপুট মূল্য $0.300 / 1M $2.000 / 1M
আউটপুট মূল্য $2.500 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 105,138 125,596
আউটপুট টোকেন 8,315 7,505
রিজনিং টোকেন 212,507 106,446
প্রতিক্রিয়া সময় (গড়) 9.48s 15.56s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 43.93s 205.28s
প্রতিক্রিয়া সময় (মোট) 208.52s 342.32s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#31 Gemini 3.5 Flash-Lite

high
খরচ
$0.023
সময়
23.6s
টোকেন
9,128 tok

#23 xAI: Grok 4.5

low
খরচ
$0.011
সময়
12.4s
টোকেন
2,018 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash-Lite 8.6 7.6 88.9% 1 15.09s 8,136 452 55,603
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

দ্রুত তুলনা

তুলনার জুটি বদলান