- র্যাঙ্ক
- #139
- মোট আউটপুট টোকেন
- 220,942
- প্রতিক্রিয়া সময় (গড়)
- 98.19s
- মোট খরচ
- $0.479
Kimi K2.5 (medium) vs GPT-5.5
average score প্রায় সমান: 7.0 vs 7.0. Kimi K2.5 (medium)-এর benchmark খরচ কম: $0.479 vs $0.544. GPT-5.5 দ্রুত: 2.35s vs 98.19s, pass rates 63.6% vs 59.1%.
- র্যাঙ্ক
- #135
- মোট আউটপুট টোকেন
- 4,915
- প্রতিক্রিয়া সময় (গড়)
- 2.35s
- মোট খরচ
- $0.544
প্রস্তাবিত মডেল
GPT-5.5
It has the best score here (7.0), while responding about 41.7x faster than Kimi K2.5 (medium).
বিস্তারিত তুলনা
| মেট্রিক | Kimi K2.5 Kimi K2.5 medium | GPT-5.5 GPT-5.5 none |
|---|---|---|
| স্কোর | 7.0 | 7.0 |
| র্যাঙ্ক | #139 | #135 |
| নির্ভরযোগ্যতা | 10.0 | 10.0 |
| ধারাবাহিকতা | 7.0 | 9.2 |
| প্রচেষ্টা | 66/66 | 66/66 |
| সঠিক টেস্ট | ||
| প্রতি চেষ্টায় পাস রেট | 63.6% | 59.1% |
| অস্থির টেস্ট | 8 | 2 |
| মোট রান | 66 | 66 |
| প্রতি ফলাফলে খরচ | 4.849 | 4.533 |
| মোট খরচ | $0.479 | $0.544 |
| ইনপুট মূল্য | $0.450 / 1M | $5.000 / 1M |
| আউটপুট মূল্য | $2.250 / 1M | $30.000 / 1M |
| মোট ইনপুট টোকেন | 118,496 | 79,294 |
| আউটপুট টোকেন | 53,522 | 4,915 |
| রিজনিং টোকেন | 167,420 | 0 |
| প্রতিক্রিয়া সময় (গড়) | 98.19s | 2.35s |
| প্রতিক্রিয়া সময় (সর্বোচ্চ) | 281.00s | 12.24s |
| প্রতিক্রিয়া সময় (মোট) | 1571.05s | 51.78s |
| প্যারামিটার | 1T মোট (32B সক্রিয়) | ~1.5T মোট (~100B সক্রিয়) |
| উপলভ্যতা | ওজন উপলভ্য | বন্ধ উৎস |
মডেল জেনারেশন শোকেস
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#139 MoonshotAI: Kimi K2.5
medium- খরচ
- $0.030
- সময়
- 58.6s
- টোকেন
- 8,683 tok
#135 GPT-5.5
none- খরচ
- $0.090
- সময়
- 54.3s
- টোকেন
- 3,063 tok
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর বনাম মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
দ্রুত তুলনা
তুলনার জুটি বদলান
Mercury 2mediumvsGPT-5.5noneGPT-5.5nonevsGLM 5.1mediumGPT-5.5nonevsGrok 4.20mediumDeepSeek V3.2mediumvsGPT-5.5noneSeed-2.0-MinimediumvsGPT-5.5noneClaude Fable 5.1lowvsKimi K2.5mediumGPT-5.5nonevsGrok 4.3mediumSeed-2.0-CodehighvsKimi K2.5mediumKAT-Coder-Pro V2.5mediumvsGPT-5.5noneKimi K2.5mediumvsGPT-5.6 SolnoneClaude Fable 5.1lowvsGPT-5.5noneGPT-5.5nonevsQwen3.7 Flashmedium