- র্যাঙ্ক
- #158
- মোট আউটপুট টোকেন
- 110,125
- প্রতিক্রিয়া সময় (গড়)
- 56.77s
- মোট খরচ
- $1.798
Ember-1 (high) vs Grok 4.3 (medium)
average score প্রায় সমান: 7.1 vs 7.0. Grok 4.3 (medium)-এর benchmark খরচ কম: $0.741 vs $1.798. Grok 4.3 (medium) দ্রুত: 44.21s vs 56.77s, pass rates 71.2% vs 66.7%.
তুলনা করা মডেল
- র্যাঙ্ক
- #159
- মোট আউটপুট টোকেন
- 225,904
- প্রতিক্রিয়া সময় (গড়)
- 44.21s
- মোট খরচ
- $0.741
প্রস্তাবিত মডেল
Grok 4.3 (medium)
It has the best score here (7.0), while costing about 2.4x less than Ember-1 (high).
বিস্তারিত তুলনা
| মেট্রিক | Ember-1 Ember-1 high | Grok 4.3 Grok 4.3 medium |
|---|---|---|
| স্কোর | 7.1 | 7.0 |
| র্যাঙ্ক | #158 | #159 |
| নির্ভরযোগ্যতা | 8.0 | 10.0 |
| ধারাবাহিকতা | 7.3 | 8.2 |
| প্রচেষ্টা | 66/66 | 66/66 |
| সঠিক টেস্ট | ||
| প্রতি চেষ্টায় পাস রেট | 71.2% | 66.7% |
| অস্থির টেস্ট | 7 | 5 |
| মোট রান | 66 | 66 |
| প্রতি ফলাফলে খরচ | 14.981 | 6.168 |
| মোট খরচ | $1.798 | $0.741 |
| ইনপুট মূল্য | $3.000 / 1M | $1.250 / 1M |
| আউটপুট মূল্য | $15.000 / 1M | $2.500 / 1M |
| মোট ইনপুট টোকেন | 48,577 | 140,244 |
| আউটপুট টোকেন | 7,345 | 13,739 |
| রিজনিং টোকেন | 102,780 | 212,165 |
| প্রতিক্রিয়া সময় (গড়) | 56.77s | 44.21s |
| প্রতিক্রিয়া সময় (সর্বোচ্চ) | 255.06s | 216.69s |
| প্রতিক্রিয়া সময় (মোট) | 1248.88s | 972.64s |
| প্যারামিটার | ~2.8T মোট (~104B সক্রিয়) | ~1.5T মোট (~150B সক্রিয়) |
| উপলভ্যতা | বন্ধ উৎস | বন্ধ উৎস |
মডেল জেনারেশন শোকেস
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#158 Ember-1
high- খরচ
- $0.038
- সময়
- 55.1s
- টোকেন
- 2,671 tok
#159 SpaceXAI: Grok 4.3
medium- খরচ
- $0.009
- সময়
- 19.0s
- টোকেন
- 3,661 tok
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর বনাম মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
দ্রুত তুলনা
তুলনার জুটি বদলান
GPT-5.6 SolnonevsGrok 4.3mediumGPT-6 LunalowvsGrok 4.3mediumEmber-1highvsGPT-5.6 SolnoneEmber-1highvsGPT-6 LunalowSpace Bunny AlphahighvsGrok 4.3mediumMercury 2.5highvsGrok 4.3mediumDeepSeek V3.2mediumvsEmber-1highGPT-5.5nonevsGrok 4.3mediumEmber-1highvsGLM 5.1mediumEmber-1highvsGPT-5.5noneEmber-1highvsMercury 2mediumSolar Pro 4highvsGrok 4.3medium