নেভিগেশন
AI BENCHY
Advertise here

MoonshotAI: Kimi K2.5 vs OpenAI: GPT-5.5

Kimi K2.5 (medium) average score-এ এগিয়ে: 7.0 vs 6.9. GPT-5.5-এর benchmark খরচ কম: $0.544 vs $0.600. GPT-5.5 দ্রুত: 2.36s vs 99.00s, pass rates 65.2% vs 56.1%.

প্রস্তাবিত মডেলGPT-5.5Its score stays close to the best score here (6.9 vs 7.0), while responding about 42.0x faster than Kimi K2.5 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-24

মেট্রিক Kimi K2.5 Kimi K2.5 medium প্রকাশ: 2026-01-27 GPT-5.5 GPT-5.5 none প্রকাশ: 2026-04-24
স্কোর 7.0 6.9
র‍্যাঙ্ক #81 #91
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.0 8.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 65.2% 56.1%
অস্থির টেস্ট 8 3
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.789 4.945
মোট খরচ $0.600 $0.544
ইনপুট মূল্য $0.571 / 1M $5.000 / 1M
আউটপুট মূল্য $2.850 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 118,448 79,285
আউটপুট টোকেন 62,124 4,915
রিজনিং টোকেন 165,243 0
প্রতিক্রিয়া সময় (গড়) 99.00s 2.36s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 281.00s 12.24s
প্রতিক্রিয়া সময় (মোট) 1485.04s 51.88s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#81 MoonshotAI: Kimi K2.5

medium
খরচ
$0.030
সময়
58.6s
টোকেন
8,683 tok

#91 GPT-5.5

none
খরচ
$0.090
সময়
54.3s
টোকেন
3,063 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

দ্রুত তুলনা

তুলনার জুটি বদলান