নেভিগেশন
Advertise here

Ember-1 (low) vs GPT-5.6 Luna (medium)

average score প্রায় সমান: 7.5 vs 7.4. GPT-5.6 Luna (medium)-এর benchmark খরচ কম: $0.072 vs $0.662. GPT-5.6 Luna (medium) দ্রুত: 7.43s vs 30.98s, pass rates 66.7% vs 62.1%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-29

তুলনা করা মডেল

র‍্যাঙ্ক
#128
মোট আউটপুট টোকেন
37,467
প্রতিক্রিয়া সময় (গড়)
30.98s
মোট খরচ
$0.662
র‍্যাঙ্ক
#140
মোট আউটপুট টোকেন
44,525
প্রতিক্রিয়া সময় (গড়)
7.43s
মোট খরচ
$0.072
প্রস্তাবিত মডেল GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 9.3x less than Ember-1 (low).

বিস্তারিত তুলনা

মেট্রিক Ember-1 Ember-1 low প্রকাশ: 2026-09-28 GPT-5.6 Luna GPT-5.6 Luna medium প্রকাশ: 2026-07-09
স্কোর 7.5 7.4
র‍্যাঙ্ক #128 #140
নির্ভরযোগ্যতা 8.1 10.0
ধারাবাহিকতা 8.5 9.2
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 66.7% 62.1%
অস্থির টেস্ট 4 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 5.085 2.601
মোট খরচ $0.662 $0.072
ইনপুট মূল্য $3.000 / 1M $0.200 / 1M
আউটপুট মূল্য $15.000 / 1M $1.200 / 1M
মোট ইনপুট টোকেন 33,011 89,685
আউটপুট টোকেন 4,780 5,701
রিজনিং টোকেন 32,687 38,824
প্রতিক্রিয়া সময় (গড়) 30.98s 7.43s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 93.10s 29.85s
প্রতিক্রিয়া সময় (মোট) 681.50s 163.54s
প্যারামিটার ~2.8T মোট (~104B সক্রিয়) ~400B মোট (~17B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#128 Ember-1

low
খরচ
$0.016
সময়
24.2s
টোকেন
1,165 tok

#140 GPT-5.6 Luna

medium
খরচ
$0.014
সময়
14.6s
টোকেন
2,362 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Ember-1 10.0 10.0 100.0% 0 37.91s 8,097 2,518 13,142
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

দ্রুত তুলনা

তুলনার জুটি বদলান