নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

MoonshotAI: Kimi K2.6 vs OpenAI: GPT-5.5

GPT-5.5 (low) average score-এ এগিয়ে: 9.3 vs 7.2. Kimi K2.6 (medium)-এর benchmark খরচ কম: $1.036 vs $1.253. GPT-5.5 (low) দ্রুত: 10.13s vs 109.98s, pass rates 63.6% vs 86.4%.

প্রস্তাবিত মডেলGPT-5.5 (low)It has the best score here (9.3), while responding about 10.9x faster than Kimi K2.6 (medium).

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-20

মেট্রিক Kimi K2.6 Kimi K2.6 medium প্রকাশ: 2026-04-20 GPT-5.5 GPT-5.5 low প্রকাশ: 2026-04-24
স্কোর 7.2 9.3
র‍্যাঙ্ক #68 #6
নির্ভরযোগ্যতা 9.4 10.0
ধারাবাহিকতা 8.3 10.0
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 63.6% 86.4%
অস্থির টেস্ট 4 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 9.821 6.594
মোট খরচ $1.036 $1.253
ইনপুট মূল্য $0.684 / 1M $5.000 / 1M
আউটপুট মূল্য $3.420 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 68,902 80,058
আউটপুট টোকেন 111,680 5,378
রিজনিং টোকেন 279,860 23,040
প্রতিক্রিয়া সময় (গড়) 109.98s 10.13s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 876.20s 56.19s
প্রতিক্রিয়া সময় (মোট) 2309.56s 222.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#68 MoonshotAI: Kimi K2.6

medium
খরচ
$0.013
সময়
103.4s
টোকেন
3,620 tok

#6 GPT-5.5

low
খরচ
$0.068
সময়
37.0s
টোকেন
2,339 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

দ্রুত তুলনা

তুলনার জুটি বদলান