- র্যাঙ্ক
- #37
- মোট আউটপুট টোকেন
- 299,460
- প্রতিক্রিয়া সময় (গড়)
- 68.59s
- মোট খরচ
- $2.042
Grok 4.5 (medium) vs GLM 5.2 (medium)
Grok 4.5 (medium) average score-এ এগিয়ে: 8.5 vs 7.8. GLM 5.2 (medium)-এর benchmark খরচ কম: $0.224 vs $2.042. GLM 5.2 (medium) দ্রুত: 23.28s vs 68.59s, pass rates 83.3% vs 80.3%.
- র্যাঙ্ক
- #65
- মোট আউটপুট টোকেন
- 61,761
- প্রতিক্রিয়া সময় (গড়)
- 23.28s
- মোট খরচ
- $0.224
প্রস্তাবিত মডেল
GLM 5.2 (medium)
Its score stays close to the best score here (7.8 vs 8.5), while costing about 9.1x less than Grok 4.5 (medium).
বিস্তারিত তুলনা
| মেট্রিক | Grok 4.5 Grok 4.5 medium | GLM 5.2 GLM 5.2 medium |
|---|---|---|
| স্কোর | 8.5 | 7.8 |
| র্যাঙ্ক | #37 | #65 |
| নির্ভরযোগ্যতা | 10.0 | 9.5 |
| ধারাবাহিকতা | 8.9 | 8.0 |
| প্রচেষ্টা | 66/66 | 63/66 |
| সঠিক টেস্ট | ||
| প্রতি চেষ্টায় পাস রেট | 83.3% | 80.3% |
| অস্থির টেস্ট | 3 | 4 |
| মোট রান | 66 | 63 |
| প্রতি ফলাফলে খরচ | 12.007 | 2.159 |
| মোট খরচ | $2.042 | $0.224 |
| ইনপুট মূল্য | $2.000 / 1M | $0.966 / 1M |
| আউটপুট মূল্য | $6.000 / 1M | $3.036 / 1M |
| মোট ইনপুট টোকেন | 122,155 | 37,199 |
| আউটপুট টোকেন | 5,514 | 12,261 |
| রিজনিং টোকেন | 293,946 | 49,500 |
| প্রতিক্রিয়া সময় (গড়) | 68.59s | 23.28s |
| প্রতিক্রিয়া সময় (সর্বোচ্চ) | 436.38s | 101.36s |
| প্রতিক্রিয়া সময় (মোট) | 1508.91s | 488.94s |
| প্যারামিটার | ~1.7T মোট (~170B সক্রিয়) | 744B মোট (40B সক্রিয়) |
| উপলভ্যতা | বন্ধ উৎস | উন্মুক্ত উৎস |
মডেল জেনারেশন শোকেস
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#37 SpaceXAI: Grok 4.5
medium- খরচ
- $0.044
- সময়
- 59.4s
- টোকেন
- 7,512 tok
#65 GLM 5.2
medium- খরচ
- $0.041
- সময়
- 195.8s
- টোকেন
- 9,287 tok
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর বনাম মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
দ্রুত তুলনা
তুলনার জুটি বদলান
Muse Spark 1.2lowvsGrok 4.5mediumQwen3.8 27BlowvsGLM 5.2mediumGPT-5.2 ChatnonevsGLM 5.2mediumQwen3.8 27BhighvsGrok 4.5mediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumQwen3.7 FlashhighvsGLM 5.2mediumQwen3.8 MaxlowvsGrok 4.5mediumInkling SmallhighvsGrok 4.5mediumGPT-5.6 TerrahighvsGLM 5.2mediumSeed-2.0-CodelowvsGLM 5.2mediumMuse Spark 1.1lowvsGrok 4.5medium