নেভিগেশন
AI BENCHY
Advertise here

Google: Gemini 3.5 Flash-Lite vs xAI: Grok 4.5

Grok 4.5 (medium) average score-এ এগিয়ে: 8.3 vs 8.1. Gemini 3.5 Flash-Lite (high)-এর benchmark খরচ কম: $0.584 vs $1.928. Gemini 3.5 Flash-Lite (high) দ্রুত: 9.48s vs 61.71s, pass rates 81.8% vs 78.8%.

প্রস্তাবিত মডেলGemini 3.5 Flash-Lite (high)Its score stays close to the best score here (8.1 vs 8.3), while costing about 3.3x less than Grok 4.5 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite high প্রকাশ: 2026-07-21 Grok 4.5 Grok 4.5 medium প্রকাশ: 2026-07-08
স্কোর 8.1 8.3
র‍্যাঙ্ক #31 #25
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.5 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 81.8% 78.8%
অস্থির টেস্ট 7 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.169 12.049
মোট খরচ $0.584 $1.928
ইনপুট মূল্য $0.300 / 1M $2.000 / 1M
আউটপুট মূল্য $2.500 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 105,138 122,146
আউটপুট টোকেন 8,315 5,514
রিজনিং টোকেন 212,507 275,053
প্রতিক্রিয়া সময় (গড়) 9.48s 61.71s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 43.93s 436.38s
প্রতিক্রিয়া সময় (মোট) 208.52s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#31 Gemini 3.5 Flash-Lite

high
খরচ
$0.023
সময়
23.6s
টোকেন
9,128 tok

#25 xAI: Grok 4.5

medium
খরচ
$0.044
সময়
59.4s
টোকেন
7,512 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash-Lite 8.6 7.6 88.9% 1 15.09s 8,136 452 55,603
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

দ্রুত তুলনা

তুলনার জুটি বদলান