- র্যাঙ্ক
- #158
- মোট আউটপুট টোকেন
- 110,125
- প্রতিক্রিয়া সময় (গড়)
- 56.77s
- মোট খরচ
- $1.798
Ember-1 (high) vs GPT-5.5
Ember-1 (high) average score-এ এগিয়ে: 7.1 vs 7.0. GPT-5.5-এর benchmark খরচ কম: $0.544 vs $1.798. GPT-5.5 দ্রুত: 2.35s vs 56.77s, pass rates 71.2% vs 59.1%.
তুলনা করা মডেল
- র্যাঙ্ক
- #165
- মোট আউটপুট টোকেন
- 4,915
- প্রতিক্রিয়া সময় (গড়)
- 2.35s
- মোট খরচ
- $0.544
প্রস্তাবিত মডেল
GPT-5.5
Its score stays close to the best score here (7.0 vs 7.1), while costing about 3.3x less than Ember-1 (high).
বিস্তারিত তুলনা
| মেট্রিক | Ember-1 Ember-1 high | GPT-5.5 GPT-5.5 none |
|---|---|---|
| স্কোর | 7.1 | 7.0 |
| র্যাঙ্ক | #158 | #165 |
| নির্ভরযোগ্যতা | 8.0 | 10.0 |
| ধারাবাহিকতা | 7.3 | 9.2 |
| প্রচেষ্টা | 66/66 | 66/66 |
| সঠিক টেস্ট | ||
| প্রতি চেষ্টায় পাস রেট | 71.2% | 59.1% |
| অস্থির টেস্ট | 7 | 2 |
| মোট রান | 66 | 66 |
| প্রতি ফলাফলে খরচ | 14.981 | 4.533 |
| মোট খরচ | $1.798 | $0.544 |
| ইনপুট মূল্য | $3.000 / 1M | $5.000 / 1M |
| আউটপুট মূল্য | $15.000 / 1M | $30.000 / 1M |
| মোট ইনপুট টোকেন | 48,577 | 79,294 |
| আউটপুট টোকেন | 7,345 | 4,915 |
| রিজনিং টোকেন | 102,780 | 0 |
| প্রতিক্রিয়া সময় (গড়) | 56.77s | 2.35s |
| প্রতিক্রিয়া সময় (সর্বোচ্চ) | 255.06s | 12.24s |
| প্রতিক্রিয়া সময় (মোট) | 1248.88s | 51.78s |
| প্যারামিটার | ~2.8T মোট (~104B সক্রিয়) | ~1.5T মোট (~100B সক্রিয়) |
| উপলভ্যতা | বন্ধ উৎস | বন্ধ উৎস |
মডেল জেনারেশন শোকেস
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#158 Ember-1
high- খরচ
- $0.038
- সময়
- 55.1s
- টোকেন
- 2,671 tok
#165 GPT-5.5
none- খরচ
- $0.090
- সময়
- 54.3s
- টোকেন
- 3,063 tok
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর বনাম মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
দ্রুত তুলনা
তুলনার জুটি বদলান
Mercury 2mediumvsGPT-5.5noneGPT-5.5nonevsGLM 5.1mediumGPT-5.5nonevsGrok 4.20mediumGPT-5.5nonevsSpace Bunny AlphahighEmber-1highvsGrok 4.3mediumEmber-1highvsGPT-5.6 SolnoneEmber-1highvsGPT-6 LunalowDeepSeek V3.2mediumvsGPT-5.5noneSeed-2.0-MinimediumvsGPT-5.5noneKimi K2.5mediumvsGPT-5.5noneDeepSeek V3.2mediumvsEmber-1highGPT-5.5nonevsGrok 4.3medium