নেভিগেশন
Advertise here

Ember-1 (low) vs Kimi K2.7 Code (medium)

average score প্রায় সমান: 7.5 vs 7.4. Ember-1 (low)-এর benchmark খরচ কম: $0.662 vs $0.668. Ember-1 (low) দ্রুত: 30.98s vs 80.09s, pass rates 66.7% vs 63.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-29

তুলনা করা মডেল

র‍্যাঙ্ক
#128
মোট আউটপুট টোকেন
37,467
প্রতিক্রিয়া সময় (গড়)
30.98s
মোট খরচ
$0.662
র‍্যাঙ্ক
#139
মোট আউটপুট টোকেন
239,546
প্রতিক্রিয়া সময় (গড়)
80.09s
মোট খরচ
$0.668
প্রস্তাবিত মডেল Ember-1 (low)

It has the best score here (7.5), while responding about 2.6x faster than Kimi K2.7 Code (medium).

বিস্তারিত তুলনা

মেট্রিক Ember-1 Ember-1 low প্রকাশ: 2026-09-28 Kimi K2.7 Code Kimi K2.7 Code medium প্রকাশ: 2026-06-12
স্কোর 7.5 7.4
র‍্যাঙ্ক #128 #139
নির্ভরযোগ্যতা 8.1 10.0
ধারাবাহিকতা 8.5 8.0
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 66.7% 63.6%
অস্থির টেস্ট 4 5
মোট রান 66 66
প্রতি ফলাফলে খরচ 5.085 7.096
মোট খরচ $0.662 $0.668
ইনপুট মূল্য $3.000 / 1M $0.657 / 1M
আউটপুট মূল্য $15.000 / 1M $3.301 / 1M
মোট ইনপুট টোকেন 33,011 72,085
আউটপুট টোকেন 4,780 57,453
রিজনিং টোকেন 32,687 182,093
প্রতিক্রিয়া সময় (গড়) 30.98s 80.09s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 93.10s 365.80s
প্রতিক্রিয়া সময় (মোট) 681.50s 1681.85s
প্যারামিটার ~2.8T মোট (~104B সক্রিয়) 1T মোট (32B সক্রিয়)
উপলভ্যতা বন্ধ উৎস ওজন উপলভ্য

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#128 Ember-1

low
খরচ
$0.016
সময়
24.2s
টোকেন
1,165 tok

#139 MoonshotAI: Kimi K2.7 Code

medium
খরচ
$0.025
সময়
138.0s
টোকেন
6,093 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Ember-1 10.0 10.0 100.0% 0 37.91s 8,097 2,518 13,142
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635

দ্রুত তুলনা

তুলনার জুটি বদলান