নেভিগেশন
Advertise here

Kimi K2.6 (medium) vs GPT-5.6 Luna (low)

average score প্রায় সমান: 6.8 vs 6.9. GPT-5.6 Luna (low)-এর benchmark খরচ কম: $0.075 vs $1.323. GPT-5.6 Luna (low) দ্রুত: 6.96s vs 121.25s, pass rates 60.9% vs 56.5%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#168
মোট আউটপুট টোকেন
396,671
প্রতিক্রিয়া সময় (গড়)
121.25s
মোট খরচ
$1.323
র‍্যাঙ্ক
#165
মোট আউটপুট টোকেন
28,001
প্রতিক্রিয়া সময় (গড়)
6.96s
মোট খরচ
$0.075
প্রস্তাবিত মডেল GPT-5.6 Luna (low)

It has the best score here (6.9), while costing about 17.8x less than Kimi K2.6 (medium).

বিস্তারিত তুলনা

মেট্রিক Kimi K2.6 Kimi K2.6 medium প্রকাশ: 2026-04-20 GPT-5.6 Luna GPT-5.6 Luna low প্রকাশ: 2026-07-09
স্কোর 6.8 6.9
র‍্যাঙ্ক #168 #165
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.4 8.3
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 60.9% 56.5%
অস্থির টেস্ট 4 5
মোট রান 69 69
প্রতি ফলাফলে খরচ 12.282 2.428
মোট খরচ $1.323 $0.075
ইনপুট মূল্য $0.650 / 1M $0.200 / 1M
আউটপুট মূল্য $3.410 / 1M $1.200 / 1M
মোট ইনপুট টোকেন 226,880 202,680
আউটপুট টোকেন 65,346 9,230
রিজনিং টোকেন 331,325 18,771
প্রতিক্রিয়া সময় (গড়) 121.25s 6.96s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 876.20s 45.74s
প্রতিক্রিয়া সময় (মোট) 2667.55s 160.19s
প্যারামিটার 1T মোট (32B সক্রিয়) ~400B মোট (~17B সক্রিয়)
উপলভ্যতা ওজন উপলভ্য বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#168 MoonshotAI: Kimi K2.6

medium
খরচ
$0.013
সময়
103.4s
টোকেন
3,620 tok

#165 GPT-5.6 Luna

low
খরচ
$0.011
সময়
10.2s
টোকেন
1,897 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

দ্রুত তুলনা

তুলনার জুটি বদলান