নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Google: Gemini 2.5 Flash vs OpenAI: GPT-5.4

সারাংশ

Gemini 2.5 Flash vs GPT-5.4 benchmark তুলনা: GPT-5.4 average score-এ এগিয়ে: 8.5 vs 8.2. Gemini 2.5 Flash-এর benchmark খরচ কম: $0.379 vs $1.210. Gemini 2.5 Flash দ্রুত: 15.49s vs 22.35s, pass rates 69.8% vs 76.2%.

প্রস্তাবিত মডেল: Gemini 2.5 Flash - Its score stays close to the best score here (8.2 vs 8.5), while costing about 3.2x less than GPT-5.4.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-18

মেট্রিক Gemini 2.5 Flash Gemini 2.5 Flash medium প্রকাশ: 2025-06-17 GPT-5.4 GPT-5.4 medium প্রকাশ: 2026-03-05
স্কোর 8.2 8.5
র‍্যাঙ্ক #24 #17
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 69.8% 76.2%
অস্থির টেস্ট 1 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 2.701 8.640
মোট খরচ $0.379 $1.210
ইনপুট মূল্য $0.300 / 1M $2.500 / 1M
আউটপুট মূল্য $2.500 / 1M $15.000 / 1M
মোট ইনপুট টোকেন 34,476 34,108
আউটপুট টোকেন 1,930 2,242
রিজনিং টোকেন 145,145 72,707
প্রতিক্রিয়া সময় (গড়) 15.49s 22.35s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 95.48s 100.41s
প্রতিক্রিয়া সময় (মোট) 325.39s 469.29s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#24 Gemini 2.5 Flash

medium
অবৈধ SVG
খরচ
$0.000
সময়
274.0s
টোকেন
0 tok

#17 GPT-5.4

medium
খরচ
$0.214
সময়
199.6s
টোকেন
14,349 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 2.5 Flash 8.4 10.0 75.0% 0 6.30s 492 255 10,233
GPT-5.4 8.3 10.0 75.0% 0 4.11s 606 240 1,511
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 2.5 Flash 7.8 10.0 66.7% 0 41.01s 6,669 543 32,303
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 2.5 Flash 10.0 10.0 100.0% 0 28.44s 12,522 303 11,922
GPT-5.4 10.0 10.0 100.0% 0 20.57s 11,019 301 3,543
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 2.5 Flash 10.0 10.0 100.0% 0 4.06s 7,257 279 2,325
GPT-5.4 10.0 10.0 100.0% 0 5.32s 7,140 234 804
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 2.5 Flash 5.9 7.2 55.6% 1 37.34s 633 18 80,702
GPT-5.4 5.3 7.2 44.4% 1 74.27s 619 61 34,748
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 2.5 Flash 4.8 10.0 0.0% 0 4.86s 486 92 1,899
GPT-5.4 4.7 3.1 33.3% 1 4.92s 477 145 321
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 2.5 Flash 9.8 10.0 100.0% 0 2.62s 615 69 1,203
GPT-5.4 10.0 10.0 100.0% 0 3.11s 660 93 897
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 2.5 Flash 7.7 10.0 66.7% 0 3.18s 558 126 2,499
GPT-5.4 8.2 7.2 88.9% 1 9.14s 642 441 3,815
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 2.5 Flash 10.0 10.0 100.0% 0 6.20s 5,088 234 1,140
GPT-5.4 10.0 10.0 100.0% 0 13.28s 5,445 264 1,031
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Gemini 2.5 Flash 3.0 10.0 0.0% 0 2.76s 156 11 919
GPT-5.4 3.0 10.0 0.0% 0 13.95s 195 30 1,821

দ্রুত তুলনা

তুলনার জুটি বদলান