নেভিগেশন
AI BENCHY
Advertise here

Kimi K2.5 (medium) vs GPT-5.6 Sol

GPT-5.6 Sol average score-এ এগিয়ে: 7.0 vs 7.0. GPT-5.6 Sol-এর benchmark খরচ কম: $0.201 vs $0.639. GPT-5.6 Sol দ্রুত: 2.17s vs 98.19s, pass rates 63.6% vs 63.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-29

র‍্যাঙ্ক
#125
মোট আউটপুট টোকেন
220,942
প্রতিক্রিয়া সময় (গড়)
98.19s
মোট খরচ
$0.639
র‍্যাঙ্ক
#118
মোট আউটপুট টোকেন
4,357
প্রতিক্রিয়া সময় (গড়)
2.17s
মোট খরচ
$0.201
প্রস্তাবিত মডেল GPT-5.6 Sol

It has the best score here (7.0), while costing about 3.2x less than Kimi K2.5 (medium).

বিস্তারিত তুলনা

মেট্রিক Kimi K2.5 Kimi K2.5 medium প্রকাশ: 2026-01-27 GPT-5.6 Sol GPT-5.6 Sol none প্রকাশ: 2026-07-09
স্কোর 7.0 7.0
র‍্যাঙ্ক #125 #118
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.0 9.0
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 63.6% 63.6%
অস্থির টেস্ট 8 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.849 4.365
মোট খরচ $0.639 $0.201
ইনপুট মূল্য $0.600 / 1M $2.000 / 1M
আউটপুট মূল্য $3.000 / 1M $10.000 / 1M
মোট ইনপুট টোকেন 118,496 78,602
আউটপুট টোকেন 53,522 4,357
রিজনিং টোকেন 167,420 0
প্রতিক্রিয়া সময় (গড়) 98.19s 2.17s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 281.00s 12.81s
প্রতিক্রিয়া সময় (মোট) 1571.05s 47.66s
প্যারামিটার 1T মোট (32B সক্রিয়) ~2T মোট (~150B সক্রিয়)
উপলভ্যতা ওজন উপলভ্য বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#125 MoonshotAI: Kimi K2.5

medium
খরচ
$0.030
সময়
58.6s
টোকেন
8,683 tok

#118 GPT-5.6 Sol

none
খরচ
$0.116
সময়
78.7s
টোকেন
3,944 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0

দ্রুত তুলনা

তুলনার জুটি বদলান