নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

OpenAI: GPT-5.4 vs xAI: Grok 4.5

GPT-5.4 (medium) average score-এ এগিয়ে: 8.5 vs 8.3. GPT-5.4 (medium)-এর benchmark খরচ কম: $1.533 vs $1.928. GPT-5.4 (medium) দ্রুত: 23.10s vs 61.71s, pass rates 77.3% vs 78.8%.

প্রস্তাবিত মডেলGPT-5.4 (medium)It has the best score here (8.5), while responding about 2.7x faster than Grok 4.5 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-22

মেট্রিক GPT-5.4 GPT-5.4 medium প্রকাশ: 2026-03-05 Grok 4.5 Grok 4.5 medium প্রকাশ: 2026-07-08
স্কোর 8.5 8.3
র‍্যাঙ্ক #21 #25
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.6 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 77.3% 78.8%
অস্থির টেস্ট 4 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 10.220 12.049
মোট খরচ $1.533 $1.928
ইনপুট মূল্য $2.500 / 1M $2.000 / 1M
আউটপুট মূল্য $15.000 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 81,127 122,146
আউটপুট টোকেন 6,155 5,514
রিজনিং টোকেন 82,515 275,053
প্রতিক্রিয়া সময় (গড়) 23.10s 61.71s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 100.41s 436.38s
প্রতিক্রিয়া সময় (মোট) 508.26s 1357.56s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#21 GPT-5.4

medium
খরচ
$0.214
সময়
199.6s
টোকেন
14,349 tok

#25 xAI: Grok 4.5

medium
খরচ
$0.044
সময়
59.4s
টোকেন
7,512 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 8.8 7.8 88.9% 1 44.36s 7,305 433 24,216
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

দ্রুত তুলনা

তুলনার জুটি বদলান