নেভিগেশন
Advertise here

Ember-1 (low) vs GPT 5.3 Chat

average score প্রায় সমান: 7.5 vs 7.5. GPT 5.3 Chat-এর benchmark খরচ কম: $0.533 vs $0.662. GPT 5.3 Chat দ্রুত: 6.56s vs 30.98s, pass rates 66.7% vs 65.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-28

তুলনা করা মডেল

র‍্যাঙ্ক
#120
মোট আউটপুট টোকেন
37,467
প্রতিক্রিয়া সময় (গড়)
30.98s
মোট খরচ
$0.662
র‍্যাঙ্ক
#122
মোট আউটপুট টোকেন
28,179
প্রতিক্রিয়া সময় (গড়)
6.56s
মোট খরচ
$0.533
প্রস্তাবিত মডেল GPT 5.3 Chat

It has the best score here (7.5), while responding about 4.7x faster than Ember-1 (low).

বিস্তারিত তুলনা

মেট্রিক Ember-1 Ember-1 low প্রকাশ: 2026-09-28 GPT 5.3 Chat GPT 5.3 Chat none প্রকাশ: 2026-03-03
স্কোর 7.5 7.5
র‍্যাঙ্ক #120 #122
নির্ভরযোগ্যতা 8.1 10.0
ধারাবাহিকতা 8.5 8.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 66.7% 65.2%
অস্থির টেস্ট 4 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 5.085 4.097
মোট খরচ $0.662 $0.533
ইনপুট মূল্য $3.000 / 1M $1.750 / 1M
আউটপুট মূল্য $15.000 / 1M $14.000 / 1M
মোট ইনপুট টোকেন 33,011 78,846
আউটপুট টোকেন 4,780 28,179
রিজনিং টোকেন 32,687 0
প্রতিক্রিয়া সময় (গড়) 30.98s 6.56s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 93.10s 18.33s
প্রতিক্রিয়া সময় (মোট) 681.50s 137.77s
প্যারামিটার ~2.8T মোট (~104B সক্রিয়) ~400B মোট (~17B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 Ember-1

low
খরচ
$0.016
সময়
24.2s
টোকেন
1,165 tok

#122 GPT 5.3 Chat

none
খরচ
$0.008
সময়
8.1s
টোকেন
634 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Ember-1 10.0 10.0 100.0% 0 37.91s 8,097 2,518 13,142
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

দ্রুত তুলনা

তুলনার জুটি বদলান