নেভিগেশন
AI BENCHY
Advertise here

Google: Gemini 3.5 Flash-Lite vs OpenAI: GPT-5.4

GPT-5.4 (medium) average score-এ এগিয়ে: 8.5 vs 8.1. Gemini 3.5 Flash-Lite (high)-এর benchmark খরচ কম: $0.584 vs $1.533. Gemini 3.5 Flash-Lite (high) দ্রুত: 9.48s vs 23.10s, pass rates 81.8% vs 77.3%.

প্রস্তাবিত মডেলGemini 3.5 Flash-Lite (high)Its score stays close to the best score here (8.1 vs 8.5), while costing about 2.6x less than GPT-5.4 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-21

মেট্রিক Gemini 3.5 Flash-Lite Gemini 3.5 Flash-Lite high প্রকাশ: 2026-07-21 GPT-5.4 GPT-5.4 medium প্রকাশ: 2026-03-05
স্কোর 8.1 8.5
র‍্যাঙ্ক #31 #21
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.5 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 81.8% 77.3%
অস্থির টেস্ট 7 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.169 10.220
মোট খরচ $0.584 $1.533
ইনপুট মূল্য $0.300 / 1M $2.500 / 1M
আউটপুট মূল্য $2.500 / 1M $15.000 / 1M
মোট ইনপুট টোকেন 105,138 81,127
আউটপুট টোকেন 8,315 6,155
রিজনিং টোকেন 212,507 82,515
প্রতিক্রিয়া সময় (গড়) 9.48s 23.10s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 43.93s 100.41s
প্রতিক্রিয়া সময় (মোট) 208.52s 508.26s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#31 Gemini 3.5 Flash-Lite

high
খরচ
$0.023
সময়
23.6s
টোকেন
9,128 tok

#21 GPT-5.4

medium
খরচ
$0.214
সময়
199.6s
টোকেন
14,349 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 3.5 Flash-Lite 8.6 7.6 88.9% 1 15.09s 8,136 452 55,603
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216

দ্রুত তুলনা

তুলনার জুটি বদলান