নেভিগেশন
AI BENCHY
Advertise here

Kimi K2.7 Code (medium) vs Grok Build 0.1 (medium)

Grok Build 0.1 (medium) average score-এ এগিয়ে: 7.6 vs 7.5. Kimi K2.7 Code (medium)-এর benchmark খরচ কম: $0.692 vs $1.097. Grok Build 0.1 (medium) দ্রুত: 52.06s vs 84.25s, pass rates 65.2% vs 63.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

র‍্যাঙ্ক
#60
মোট আউটপুট টোকেন
262,507
প্রতিক্রিয়া সময় (গড়)
84.25s
মোট খরচ
$0.692
র‍্যাঙ্ক
#55
মোট আউটপুট টোকেন
494,663
প্রতিক্রিয়া সময় (গড়)
52.06s
মোট খরচ
$1.097
প্রস্তাবিত মডেল Kimi K2.7 Code (medium)

Its score stays close to the best score here (7.5 vs 7.6), while costing about 1.6x less than Grok Build 0.1 (medium).

বিস্তারিত তুলনা

মেট্রিক Kimi K2.7 Code Kimi K2.7 Code medium প্রকাশ: 2026-06-12 Grok Build 0.1 Grok Build 0.1 medium প্রকাশ: 2026-05-21
স্কোর 7.5 7.6
র‍্যাঙ্ক #60 #55
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.3 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 65.2% 63.6%
অস্থির টেস্ট 4 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 6.457 7.830
মোট খরচ $0.692 $1.097
ইনপুট মূল্য $0.780 / 1M $1.000 / 1M
আউটপুট মূল্য $3.500 / 1M $2.000 / 1M
মোট ইনপুট টোকেন 72,073 106,751
আউটপুট টোকেন 83,714 7,993
রিজনিং টোকেন 178,793 486,670
প্রতিক্রিয়া সময় (গড়) 84.25s 52.06s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 365.80s 252.69s
প্রতিক্রিয়া সময় (মোট) 1769.22s 1145.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 MoonshotAI: Kimi K2.7 Code

medium
খরচ
$0.025
সময়
138.0s
টোকেন
6,093 tok

#55 xAI: Grok Build 0.1

medium
খরচ
$0.028
সময়
81.3s
টোকেন
14,009 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452

দ্রুত তুলনা

তুলনার জুটি বদলান