- র্যাঙ্ক
- #177
- মোট আউটপুট টোকেন
- 220,942
- প্রতিক্রিয়া সময় (গড়)
- 98.19s
- মোট খরচ
- $0.479
Kimi K2.5 (medium) vs Grok 4.20 (medium)
average score প্রায় সমান: 7.0 vs 7.0. Kimi K2.5 (medium)-এর benchmark খরচ কম: $0.479 vs $0.805. Grok 4.20 (medium) দ্রুত: 32.56s vs 98.19s, pass rates 63.6% vs 60.6%.
তুলনা করা মডেল
- র্যাঙ্ক
- #175
- মোট আউটপুট টোকেন
- 270,259
- প্রতিক্রিয়া সময় (গড়)
- 32.56s
- মোট খরচ
- $0.805
প্রস্তাবিত মডেল
Grok 4.20 (medium)
It has the best score here (7.0), while responding about 3.0x faster than Kimi K2.5 (medium).
বিস্তারিত তুলনা
| মেট্রিক | Kimi K2.5 Kimi K2.5 medium | Grok 4.20 Grok 4.20 medium |
|---|---|---|
| স্কোর | 7.0 | 7.0 |
| র্যাঙ্ক | #177 | #175 |
| নির্ভরযোগ্যতা | 10.0 | 10.0 |
| ধারাবাহিকতা | 7.0 | 8.2 |
| প্রচেষ্টা | 66/66 | 66/66 |
| সঠিক টেস্ট | ||
| প্রতি চেষ্টায় পাস রেট | 63.6% | 60.6% |
| অস্থির টেস্ট | 8 | 5 |
| মোট রান | 66 | 66 |
| প্রতি ফলাফলে খরচ | 4.849 | 10.365 |
| মোট খরচ | $0.479 | $0.805 |
| ইনপুট মূল্য | $0.450 / 1M | $1.250 / 1M |
| আউটপুট মূল্য | $2.250 / 1M | $2.500 / 1M |
| মোট ইনপুট টোকেন | 118,496 | 102,986 |
| আউটপুট টোকেন | 53,522 | 5,860 |
| রিজনিং টোকেন | 167,420 | 264,399 |
| প্রতিক্রিয়া সময় (গড়) | 98.19s | 32.56s |
| প্রতিক্রিয়া সময় (সর্বোচ্চ) | 281.00s | 199.66s |
| প্রতিক্রিয়া সময় (মোট) | 1571.05s | 716.36s |
| প্যারামিটার | 1T মোট (32B সক্রিয়) | ~1T মোট (~100B সক্রিয়) |
| উপলভ্যতা | ওজন উপলভ্য | বন্ধ উৎস |
মডেল জেনারেশন শোকেস
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#177 MoonshotAI: Kimi K2.5
medium- খরচ
- $0.030
- সময়
- 58.6s
- টোকেন
- 8,683 tok
#175 SpaceXAI: Grok 4.20
medium- খরচ
- $0.041
- সময়
- 110.3s
- টোকেন
- 16,336 tok
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর বনাম মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
দ্রুত তুলনা
তুলনার জুটি বদলান
GPT-5.5nonevsGrok 4.20mediumSpace Bunny AlphahighvsGrok 4.20mediumKimi K2.5mediumvsGPT-5.5noneKimi K2.5mediumvsSpace Bunny AlphahighClaude Fable 5.1lowvsKimi K2.5mediumGPT-6 LunalowvsGrok 4.20mediumGPT-5.6 SolnonevsGrok 4.20mediumSeed-2.0-CodehighvsKimi K2.5mediumClaude Fable 5.1lowvsGrok 4.20mediumEmber-1highvsGrok 4.20mediumKimi K2.5mediumvsGPT-6 LunalowKimi K2.5mediumvsGPT-5.6 Solnone