- র্যাঙ্ক
- #181
- মোট আউটপুট টোকেন
- 186,901
- প্রতিক্রিয়া সময় (গড়)
- 97.34s
- মোট খরচ
- $3.264
Ember-1 (max) vs GPT-5.5
average score প্রায় সমান: 6.7 vs 6.6. GPT-5.5-এর benchmark খরচ কম: $1.212 vs $3.264. GPT-5.5 দ্রুত: 4.75s vs 97.34s, pass rates 59.4% vs 56.5%.
তুলনা করা মডেল
- র্যাঙ্ক
- #185
- মোট আউটপুট টোকেন
- 6,197
- প্রতিক্রিয়া সময় (গড়)
- 4.75s
- মোট খরচ
- $1.212
প্রস্তাবিত মডেল
GPT-5.5
It has the best score here (6.6), while costing about 2.7x less than Ember-1 (max).
বিস্তারিত তুলনা
| মেট্রিক | Ember-1 Ember-1 max | GPT-5.5 GPT-5.5 none |
|---|---|---|
| স্কোর | 6.7 | 6.6 |
| র্যাঙ্ক | #181 | #185 |
| নির্ভরযোগ্যতা | 8.3 | 10.0 |
| ধারাবাহিকতা | 7.8 | 9.3 |
| প্রচেষ্টা | 69/69 | 69/69 |
| সঠিক টেস্ট | ||
| প্রতি চেষ্টায় পাস রেট | 59.4% | 56.5% |
| অস্থির টেস্ট | 6 | 2 |
| মোট রান | 69 | 69 |
| প্রতি ফলাফলে খরচ | 29.671 | 10.096 |
| মোট খরচ | $3.264 | $1.212 |
| ইনপুট মূল্য | $3.000 / 1M | $5.000 / 1M |
| আউটপুট মূল্য | $15.000 / 1M | $30.000 / 1M |
| মোট ইনপুট টোকেন | 153,399 | 205,108 |
| আউটপুট টোকেন | 7,803 | 6,197 |
| রিজনিং টোকেন | 179,098 | 0 |
| প্রতিক্রিয়া সময় (গড়) | 97.34s | 4.75s |
| প্রতিক্রিয়া সময় (সর্বোচ্চ) | 587.08s | 57.53s |
| প্রতিক্রিয়া সময় (মোট) | 2238.73s | 109.31s |
| প্যারামিটার | ~2.8T মোট (~104B সক্রিয়) | ~1.5T মোট (~100B সক্রিয়) |
| উপলভ্যতা | বন্ধ উৎস | বন্ধ উৎস |
মডেল জেনারেশন শোকেস
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#181 Ember-1
max- খরচ
- $0.163
- সময়
- 229.4s
- টোকেন
- 11,002 tok
#185 GPT-5.5
none- খরচ
- $0.090
- সময়
- 54.3s
- টোকেন
- 3,063 tok
স্কোর অনুযায়ী শীর্ষ মডেল
স্কোর বনাম মোট খরচ
প্রতিক্রিয়া সময় (গড়)
স্কোর vs প্রতিক্রিয়া সময় (গড়)
মোট আউটপুট টোকেন
স্কোর vs মোট আউটপুট টোকেন
বিভাগভিত্তিক বিশ্লেষণ
দ্রুত তুলনা
তুলনার জুটি বদলান
Ember-1maxvsGPT 5.3 ChatnoneEmber-1maxvsMiniMax M3mediumGPT-5.5nonevsGLM 5.3 FlashlowEmber-1maxvsGPT-5.6 SolnoneEmber-1maxvsGrok 4.7highEmber-1maxvsSolar Pro 4lowEmber-1maxvsQwen3.5-FlashnoneGPT-5.5nonevsQwen3.7 FlashmediumEmber-1maxvsGLM 5.3 FlashlowMiniMax M3mediumvsGPT-5.5noneGPT-5.5nonevsGrok 4.7highLongCat 2.0lowvsGPT-5.5none