- র্যাঙ্ক
- #139
- মোট আউটপুট টোকেন
- 225,904
- প্রতিক্রিয়া সময় (গড়)
- 44.21s
- মোট খরচ
- $0.741
Grok 4.3 (medium) vs GLM 5.1 (medium)
average score প্রায় সমান: 7.0 vs 7.0. GLM 5.1 (medium)-এর benchmark খরচ কম: $0.727 vs $0.741. Grok 4.3 (medium) দ্রুত: 44.21s vs 58.80s, pass rates 66.7% vs 65.2%.
তুলনা করা মডেল
- র্যাঙ্ক
- #142
- মোট আউটপুট টোকেন
- 215,889
- প্রতিক্রিয়া সময় (গড়)
- 58.80s
- মোট খরচ
- $0.727
প্রস্তাবিত মডেল
Grok 4.3 (medium)
It has the strongest score in this comparison (7.0) and the best overall balance of cost and response time across all 2 models.
বিস্তারিত তুলনা
| মেট্রিক | Grok 4.3 Grok 4.3 medium | GLM 5.1 GLM 5.1 medium |
|---|---|---|
| স্কোর | 7.0 | 7.0 |
| র্যাঙ্ক | #139 | #142 |
| নির্ভরযোগ্যতা | 10.0 | 8.1 |
| ধারাবাহিকতা | 8.2 | 8.4 |
| প্রচেষ্টা | 66/66 | 66/66 |
| সঠিক টেস্ট | ||
| প্রতি চেষ্টায় পাস রেট | 66.7% | 65.2% |
| অস্থির টেস্ট | 5 | 4 |
| মোট রান | 66 | 66 |
| প্রতি ফলাফলে খরচ | 6.168 | 6.923 |
| মোট খরচ | $0.741 | $0.727 |
| ইনপুট মূল্য | $1.250 / 1M | $0.966 / 1M |
| আউটপুট মূল্য | $2.500 / 1M | $3.036 / 1M |
| মোট ইনপুট টোকেন | 140,244 | 82,592 |
| আউটপুট টোকেন | 13,739 | 16,089 |
| রিজনিং টোকেন | 212,165 | 199,800 |
| প্রতিক্রিয়া সময় (গড়) | 44.21s | 58.80s |
| প্রতিক্রিয়া সময় (সর্বোচ্চ) | 216.69s | 308.75s |
| প্রতিক্রিয়া সময় (মোট) | 972.64s | 1234.72s |
| প্যারামিটার | ~1.5T মোট (~150B সক্রিয়) | 744B মোট (40B সক্রিয়) |
| উপলভ্যতা | বন্ধ উৎস | উন্মুক্ত উৎস |
মডেল জেনারেশন শোকেস
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#139 SpaceXAI: Grok 4.3
medium- খরচ
- $0.009
- সময়
- 19.0s
- টোকেন
- 3,661 tok
#142 GLM 5.1
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- খরচ
- $0.000
- সময়
- 300.0s
- টোকেন
- 0 tok
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর বনাম মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
দ্রুত তুলনা
তুলনার জুটি বদলান
GPT-5.5nonevsGLM 5.1mediumGPT-5.6 SolnonevsGrok 4.3mediumMercury 2.5highvsGrok 4.3mediumGPT-5.6 SolnonevsGLM 5.1mediumGPT-5.5nonevsGrok 4.3mediumSolar Pro 4highvsGrok 4.3mediumClaude Fable 5.1lowvsGLM 5.1mediumMercury 2.5highvsGLM 5.1mediumSeed-2.0-CodehighvsGLM 5.1mediumStep 3.7 FlashlowvsGrok 4.3mediumMuse Glimmer 30BlowvsGrok 4.3mediumSolar Pro 4highvsGLM 5.1medium