- র্যাঙ্ক
- #158
- মোট আউটপুট টোকেন
- 110,125
- প্রতিক্রিয়া সময় (গড়)
- 56.77s
- মোট খরচ
- $1.798
Ember-1 (high) vs GLM 5.1 (medium)
Ember-1 (high) average score-এ এগিয়ে: 7.1 vs 7.0. GLM 5.1 (medium)-এর benchmark খরচ কম: $1.053 vs $1.798. Ember-1 (high) দ্রুত: 56.77s vs 58.80s, pass rates 71.2% vs 65.2%.
তুলনা করা মডেল
- র্যাঙ্ক
- #164
- মোট আউটপুট টোকেন
- 215,889
- প্রতিক্রিয়া সময় (গড়)
- 58.80s
- মোট খরচ
- $1.053
প্রস্তাবিত মডেল
GLM 5.1 (medium)
Its score stays close to the best score here (7.0 vs 7.1), while costing about 1.7x less than Ember-1 (high).
বিস্তারিত তুলনা
| মেট্রিক | Ember-1 Ember-1 high | GLM 5.1 GLM 5.1 medium |
|---|---|---|
| স্কোর | 7.1 | 7.0 |
| র্যাঙ্ক | #158 | #164 |
| নির্ভরযোগ্যতা | 8.0 | 8.1 |
| ধারাবাহিকতা | 7.3 | 8.4 |
| প্রচেষ্টা | 66/66 | 66/66 |
| সঠিক টেস্ট | ||
| প্রতি চেষ্টায় পাস রেট | 71.2% | 65.2% |
| অস্থির টেস্ট | 7 | 4 |
| মোট রান | 66 | 66 |
| প্রতি ফলাফলে খরচ | 14.981 | 6.923 |
| মোট খরচ | $1.798 | $1.053 |
| ইনপুট মূল্য | $3.000 / 1M | $1.400 / 1M |
| আউটপুট মূল্য | $15.000 / 1M | $4.400 / 1M |
| মোট ইনপুট টোকেন | 48,577 | 82,592 |
| আউটপুট টোকেন | 7,345 | 16,089 |
| রিজনিং টোকেন | 102,780 | 199,800 |
| প্রতিক্রিয়া সময় (গড়) | 56.77s | 58.80s |
| প্রতিক্রিয়া সময় (সর্বোচ্চ) | 255.06s | 308.75s |
| প্রতিক্রিয়া সময় (মোট) | 1248.88s | 1234.72s |
| প্যারামিটার | ~2.8T মোট (~104B সক্রিয়) | 744B মোট (40B সক্রিয়) |
| উপলভ্যতা | বন্ধ উৎস | উন্মুক্ত উৎস |
মডেল জেনারেশন শোকেস
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#158 Ember-1
high- খরচ
- $0.038
- সময়
- 55.1s
- টোকেন
- 2,671 tok
#164 GLM 5.1
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- খরচ
- $0.000
- সময়
- 300.0s
- টোকেন
- 0 tok
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর বনাম মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
দ্রুত তুলনা
তুলনার জুটি বদলান
GPT-5.5nonevsGLM 5.1mediumSpace Bunny AlphahighvsGLM 5.1mediumEmber-1highvsGrok 4.3mediumEmber-1highvsGPT-5.6 SolnoneEmber-1highvsGPT-6 LunalowGPT-6 LunalowvsGLM 5.1mediumDeepSeek V3.2mediumvsEmber-1highGPT-5.6 SolnonevsGLM 5.1mediumEmber-1highvsGPT-5.5noneEmber-1highvsMercury 2mediumEmber-1highvsGrok 4.20mediumClaude Fable 5.1lowvsGLM 5.1medium