নেভিগেশন
AI BENCHY
Advertise here

MoonshotAI: Kimi K2.7 Code vs OpenAI: GPT-5.6 Luna

average score প্রায় সমান: 7.5 vs 7.6. GPT-5.6 Luna (medium)-এর benchmark খরচ কম: $0.352 vs $0.692. GPT-5.6 Luna (medium) দ্রুত: 7.28s vs 84.25s, pass rates 65.2% vs 65.2%.

প্রস্তাবিত মডেলGPT-5.6 Luna (medium)It has the best score here (7.6), while costing about 2.0x less than Kimi K2.7 Code (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-25

তুলনার সারাংশ

র‍্যাঙ্ক
#60
মোট আউটপুট টোকেন
262,507
প্রতিক্রিয়া সময় (গড়)
84.25s
মোট খরচ
$0.692
র‍্যাঙ্ক
#57
মোট আউটপুট টোকেন
43,679
প্রতিক্রিয়া সময় (গড়)
7.28s
মোট খরচ
$0.352

বিস্তারিত তুলনা

মেট্রিক Kimi K2.7 Code Kimi K2.7 Code medium প্রকাশ: 2026-06-12 GPT-5.6 Luna GPT-5.6 Luna medium প্রকাশ: 2026-07-09
স্কোর 7.5 7.6
র‍্যাঙ্ক #60 #57
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.3 9.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 65.2% 65.2%
অস্থির টেস্ট 4 1
মোট রান 66 66
প্রতি ফলাফলে খরচ 6.457 2.513
মোট খরচ $0.692 $0.352
ইনপুট মূল্য $0.780 / 1M $1.000 / 1M
আউটপুট মূল্য $3.500 / 1M $6.000 / 1M
মোট ইনপুট টোকেন 72,073 89,676
আউটপুট টোকেন 83,714 5,699
রিজনিং টোকেন 178,793 37,980
প্রতিক্রিয়া সময় (গড়) 84.25s 7.28s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 365.80s 29.85s
প্রতিক্রিয়া সময় (মোট) 1769.22s 160.27s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 MoonshotAI: Kimi K2.7 Code

medium
খরচ
$0.025
সময়
138.0s
টোকেন
6,093 tok

#57 GPT-5.6 Luna

medium
খরচ
$0.014
সময়
14.6s
টোকেন
2,362 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

দ্রুত তুলনা

তুলনার জুটি বদলান