নেভিগেশন
Advertise here

Ember-1 (max) vs GPT 5.3 Chat

average score প্রায় সমান: 6.7 vs 6.7. GPT 5.3 Chat-এর benchmark খরচ কম: $0.533 vs $3.264. GPT 5.3 Chat দ্রুত: 6.31s vs 97.34s, pass rates 59.4% vs 62.3%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#181
মোট আউটপুট টোকেন
186,901
প্রতিক্রিয়া সময় (গড়)
97.34s
মোট খরচ
$3.264
র‍্যাঙ্ক
#182
মোট আউটপুট টোকেন
28,179
প্রতিক্রিয়া সময় (গড়)
6.31s
মোট খরচ
$0.533
প্রস্তাবিত মডেল GPT 5.3 Chat

It has the best score here (6.7), while costing about 6.1x less than Ember-1 (max).

বিস্তারিত তুলনা

মেট্রিক Ember-1 Ember-1 max প্রকাশ: 2026-09-28 GPT 5.3 Chat GPT 5.3 Chat none প্রকাশ: 2026-03-03
স্কোর 6.7 6.7
র‍্যাঙ্ক #181 #182
নির্ভরযোগ্যতা 8.3 10.0
ধারাবাহিকতা 7.8 8.6
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 59.4% 62.3%
অস্থির টেস্ট 6 4
মোট রান 69 69
প্রতি ফলাফলে খরচ 29.671 4.097
মোট খরচ $3.264 $0.533
ইনপুট মূল্য $3.000 / 1M $0.000 / 1M
আউটপুট মূল্য $15.000 / 1M $0.000 / 1M
মোট ইনপুট টোকেন 153,399 78,846
আউটপুট টোকেন 7,803 28,179
রিজনিং টোকেন 179,098 0
প্রতিক্রিয়া সময় (গড়) 97.34s 6.31s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 587.08s 18.33s
প্রতিক্রিয়া সময় (মোট) 2238.73s 138.73s
প্যারামিটার ~2.8T মোট (~104B সক্রিয়) ~400B মোট (~17B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#181 Ember-1

max
খরচ
$0.163
সময়
229.4s
টোকেন
11,002 tok

#182 GPT 5.3 Chat

none
খরচ
$0.008
সময়
8.1s
টোকেন
634 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Ember-1 5.2 4.4 55.6% 2 105.09s 3,362 1,149 27,957
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

দ্রুত তুলনা

তুলনার জুটি বদলান