নেভিগেশন
AI BENCHY
Advertise here

GPT-5.4 Nano (medium) vs Grok Build 0.1 (medium)

Grok Build 0.1 (medium) average score-এ এগিয়ে: 7.6 vs 7.5. GPT-5.4 Nano (medium)-এর benchmark খরচ কম: $0.138 vs $1.097. GPT-5.4 Nano (medium) দ্রুত: 13.24s vs 52.06s, pass rates 65.2% vs 63.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-28

র‍্যাঙ্ক
#62
মোট আউটপুট টোকেন
97,122
প্রতিক্রিয়া সময় (গড়)
13.24s
মোট খরচ
$0.138
র‍্যাঙ্ক
#56
মোট আউটপুট টোকেন
494,663
প্রতিক্রিয়া সময় (গড়)
52.06s
মোট খরচ
$1.097
প্রস্তাবিত মডেল GPT-5.4 Nano (medium)

Its score stays close to the best score here (7.5 vs 7.6), while costing about 7.9x less than Grok Build 0.1 (medium).

বিস্তারিত তুলনা

মেট্রিক GPT-5.4 Nano GPT-5.4 Nano medium প্রকাশ: 2026-03-17 Grok Build 0.1 Grok Build 0.1 medium প্রকাশ: 2026-05-21
স্কোর 7.5 7.6
র‍্যাঙ্ক #62 #56
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.5 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 65.2% 63.6%
অস্থির টেস্ট 4 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 1.150 7.830
মোট খরচ $0.138 $1.097
ইনপুট মূল্য $0.200 / 1M $1.000 / 1M
আউটপুট মূল্য $1.250 / 1M $2.000 / 1M
মোট ইনপুট টোকেন 82,819 106,751
আউটপুট টোকেন 7,100 7,993
রিজনিং টোকেন 90,022 486,670
প্রতিক্রিয়া সময় (গড়) 13.24s 52.06s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 94.06s 252.69s
প্রতিক্রিয়া সময় (মোট) 291.33s 1145.27s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 GPT-5.4 Nano

medium
খরচ
$0.007
সময়
24.6s
টোকেন
4,943 tok

#56 xAI: Grok Build 0.1

medium
খরচ
$0.028
সময়
81.3s
টোকেন
14,009 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

দ্রুত তুলনা

তুলনার জুটি বদলান