নেভিগেশন
Advertise here

Kimi K2.7 Code (medium) vs GPT 5.3 Chat

average score প্রায় সমান: 7.4 vs 7.5. GPT 5.3 Chat-এর benchmark খরচ কম: $0.533 vs $0.709. GPT 5.3 Chat দ্রুত: 6.56s vs 80.09s, pass rates 63.6% vs 65.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-10

তুলনা করা মডেল

র‍্যাঙ্ক
#114
মোট আউটপুট টোকেন
239,546
প্রতিক্রিয়া সময় (গড়)
80.09s
মোট খরচ
$0.709
র‍্যাঙ্ক
#105
মোট আউটপুট টোকেন
28,179
প্রতিক্রিয়া সময় (গড়)
6.56s
মোট খরচ
$0.533
প্রস্তাবিত মডেল GPT 5.3 Chat

It has the best score here (7.5), while responding about 12.2x faster than Kimi K2.7 Code (medium).

বিস্তারিত তুলনা

মেট্রিক Kimi K2.7 Code Kimi K2.7 Code medium প্রকাশ: 2026-06-12 GPT 5.3 Chat GPT 5.3 Chat none প্রকাশ: 2026-03-03
স্কোর 7.4 7.5
র‍্যাঙ্ক #114 #105
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.0 8.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 63.6% 65.2%
অস্থির টেস্ট 5 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 7.096 4.097
মোট খরচ $0.709 $0.533
ইনপুট মূল্য $0.710 / 1M $1.750 / 1M
আউটপুট মূল্য $3.500 / 1M $14.000 / 1M
মোট ইনপুট টোকেন 72,085 78,846
আউটপুট টোকেন 57,453 28,179
রিজনিং টোকেন 182,093 0
প্রতিক্রিয়া সময় (গড়) 80.09s 6.56s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 365.80s 18.33s
প্রতিক্রিয়া সময় (মোট) 1681.85s 137.77s
প্যারামিটার 1T মোট (32B সক্রিয়) ~400B মোট (~17B সক্রিয়)
উপলভ্যতা ওজন উপলভ্য বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#114 MoonshotAI: Kimi K2.7 Code

medium
খরচ
$0.025
সময়
138.0s
টোকেন
6,093 tok

#105 GPT 5.3 Chat

none
খরচ
$0.008
সময়
8.1s
টোকেন
634 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.7 Code 7.8 9.3 66.7% 0 146.73s 4,650 1,864 25,635
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

দ্রুত তুলনা

তুলনার জুটি বদলান