নেভিগেশন
Advertise here

Ember-1 (low) vs GPT-5.4 Nano (medium)

average score প্রায় সমান: 7.5 vs 7.5. GPT-5.4 Nano (medium)-এর benchmark খরচ কম: $0.142 vs $0.662. GPT-5.4 Nano (medium) দ্রুত: 13.32s vs 30.98s, pass rates 66.7% vs 65.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-28

তুলনা করা মডেল

র‍্যাঙ্ক
#120
মোট আউটপুট টোকেন
37,467
প্রতিক্রিয়া সময় (গড়)
30.98s
মোট খরচ
$0.662
র‍্যাঙ্ক
#117
মোট আউটপুট টোকেন
99,881
প্রতিক্রিয়া সময় (গড়)
13.32s
মোট খরচ
$0.142
প্রস্তাবিত মডেল GPT-5.4 Nano (medium)

It has the best score here (7.5), while costing about 4.7x less than Ember-1 (low).

বিস্তারিত তুলনা

মেট্রিক Ember-1 Ember-1 low প্রকাশ: 2026-09-28 GPT-5.4 Nano GPT-5.4 Nano medium প্রকাশ: 2026-03-17
স্কোর 7.5 7.5
র‍্যাঙ্ক #120 #117
নির্ভরযোগ্যতা 8.1 10.0
ধারাবাহিকতা 8.5 8.5
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 66.7% 65.2%
অস্থির টেস্ট 4 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 5.085 1.179
মোট খরচ $0.662 $0.142
ইনপুট মূল্য $3.000 / 1M $0.200 / 1M
আউটপুট মূল্য $15.000 / 1M $1.250 / 1M
মোট ইনপুট টোকেন 33,011 82,828
আউটপুট টোকেন 4,780 7,100
রিজনিং টোকেন 32,687 92,781
প্রতিক্রিয়া সময় (গড়) 30.98s 13.32s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 93.10s 94.06s
প্রতিক্রিয়া সময় (মোট) 681.50s 292.97s
প্যারামিটার ~2.8T মোট (~104B সক্রিয়) ~120B মোট (~5B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 Ember-1

low
খরচ
$0.016
সময়
24.2s
টোকেন
1,165 tok

#117 GPT-5.4 Nano

medium
খরচ
$0.007
সময়
24.6s
টোকেন
4,943 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Ember-1 10.0 10.0 100.0% 0 37.91s 8,097 2,518 13,142
GPT-5.4 Nano 6.1 4.7 66.7% 2 19.12s 7,305 516 20,778

দ্রুত তুলনা

তুলনার জুটি বদলান