- র্যাঙ্ক
- #159
- মোট আউটপুট টোকেন
- 42,315
- প্রতিক্রিয়া সময় (গড়)
- 16.44s
- মোট খরচ
- $0.781
Grok 4.6 (low) vs MiMo-V2.5 (medium)
MiMo-V2.5 (medium) average score-এ এগিয়ে: 7.1 vs 6.9. MiMo-V2.5 (medium)-এর benchmark খরচ কম: $0.419 vs $0.781. Grok 4.6 (low) দ্রুত: 16.44s vs 49.20s, pass rates 66.7% vs 69.6%.
তুলনা করা মডেল
- র্যাঙ্ক
- #152
- মোট আউটপুট টোকেন
- 341,511
- প্রতিক্রিয়া সময় (গড়)
- 49.20s
- মোট খরচ
- $0.419
প্রস্তাবিত মডেল
MiMo-V2.5 (medium)
It has the best score here (7.1), while costing about 1.9x less than Grok 4.6 (low).
বিস্তারিত তুলনা
| মেট্রিক | Grok 4.6 Grok 4.6 low | MiMo-V2.5 MiMo-V2.5 medium |
|---|---|---|
| স্কোর | 6.9 | 7.1 |
| র্যাঙ্ক | #159 | #152 |
| নির্ভরযোগ্যতা | 10.0 | 10.0 |
| ধারাবাহিকতা | 9.6 | 7.6 |
| প্রচেষ্টা | 69/69 | 69/69 |
| সঠিক টেস্ট | ||
| প্রতি চেষ্টায় পাস রেট | 66.7% | 69.6% |
| অস্থির টেস্ট | 1 | 7 |
| মোট রান | 69 | 69 |
| প্রতি ফলাফলে খরচ | 5.205 | 3.491 |
| মোট খরচ | $0.781 | $0.419 |
| ইনপুট মূল্য | $2.000 / 1M | $0.140 / 1M |
| আউটপুট মূল্য | $6.000 / 1M | $0.280 / 1M |
| মোট ইনপুট টোকেন | 263,427 | 259,664 |
| আউটপুট টোকেন | 6,006 | 8,414 |
| রিজনিং টোকেন | 36,309 | 333,097 |
| প্রতিক্রিয়া সময় (গড়) | 16.44s | 49.20s |
| প্রতিক্রিয়া সময় (সর্বোচ্চ) | 57.97s | 316.27s |
| প্রতিক্রিয়া সময় (মোট) | 378.14s | 1131.69s |
| প্যারামিটার | ~1.7T মোট (~170B সক্রিয়) | 310B মোট (15B সক্রিয়) |
| উপলভ্যতা | বন্ধ উৎস | উন্মুক্ত উৎস |
মডেল জেনারেশন শোকেস
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#159 SpaceXAI: Grok 4.6
low- খরচ
- $0.011
- সময়
- 26.0s
- টোকেন
- 1,941 tok
#152 MiMo-V2.5
medium- খরচ
- $0.002
- সময়
- 54.8s
- টোকেন
- 5,247 tok
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর বনাম মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
দ্রুত তুলনা
তুলনার জুটি বদলান
Qwen3.5-122B-A10BmediumvsGrok 4.6lowGPT-5.2 ChatnonevsMiMo-V2.5mediumKimi K2.7 CodemediumvsGrok 4.6lowGemini 3.1 Flash Lite PreviewmediumvsGrok 4.6lowGemini 3.1 Flash LitemediumvsGrok 4.6lowEmber-1highvsGrok 4.6lowGPT-5.2 ChatnonevsGrok 4.6lowEmber-1lowvsMiMo-V2.5mediumGemma 4 31Bmediumবিনামূল্যে উপলভ্যvsGrok 4.6lowClaude Opus 5nonevsMiMo-V2.5mediumClaude Opus 4.8nonevsGrok 4.6lowGemini 3 Flash PreviewlowvsMiMo-V2.5medium