- रैंक
- #181
- कुल आउटपुट टोकन
- 186,901
- प्रतिक्रिया समय (औसत)
- 97.34s
- कुल लागत
- $3.264
Ember-1 (max) vs GPT-5.5
average score लगभग बराबर है: 6.7 vs 6.6. GPT-5.5 की benchmark लागत कम है: $1.212 vs $3.264. GPT-5.5 तेज है: 4.75s vs 97.34s, pass rates 59.4% vs 56.5%.
तुलना किए गए मॉडल
- रैंक
- #185
- कुल आउटपुट टोकन
- 6,197
- प्रतिक्रिया समय (औसत)
- 4.75s
- कुल लागत
- $1.212
अनुशंसित मॉडल
GPT-5.5
It has the best score here (6.6), while costing about 2.7x less than Ember-1 (max).
विस्तृत तुलना
| मेट्रिक | Ember-1 Ember-1 max | GPT-5.5 GPT-5.5 none |
|---|---|---|
| स्कोर | 6.7 | 6.6 |
| रैंक | #181 | #185 |
| विश्वसनीयता | 8.3 | 10.0 |
| संगति | 7.8 | 9.3 |
| प्रयास | 69/69 | 69/69 |
| सही परीक्षण | ||
| प्रति प्रयास पास दर | 59.4% | 56.5% |
| अस्थिर टेस्ट | 6 | 2 |
| कुल रन | 69 | 69 |
| प्रति परिणाम लागत | 29.671 | 10.096 |
| कुल लागत | $3.264 | $1.212 |
| इनपुट कीमत | $3.000 / 1M | $5.000 / 1M |
| आउटपुट कीमत | $15.000 / 1M | $30.000 / 1M |
| कुल इनपुट टोकन | 153,399 | 205,108 |
| आउटपुट टोकन | 7,803 | 6,197 |
| रीजनिंग टोकन | 179,098 | 0 |
| प्रतिक्रिया समय (औसत) | 97.34s | 4.75s |
| प्रतिक्रिया समय (अधिकतम) | 587.08s | 57.53s |
| प्रतिक्रिया समय (कुल) | 2238.73s | 109.31s |
| पैरामीटर | ~2.8T कुल (~104B सक्रिय) | ~1.5T कुल (~100B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#181 Ember-1
max- लागत
- $0.163
- समय
- 229.4s
- टोकन
- 11,002 tok
#185 GPT-5.5
none- लागत
- $0.090
- समय
- 54.3s
- टोकन
- 3,063 tok
स्कोर के अनुसार शीर्ष मॉडल
स्कोर बनाम कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
श्रेणी विवरण
त्वरित तुलना
तुलना जोड़ी बदलें
Ember-1maxvsGPT 5.3 ChatnoneEmber-1maxvsMiniMax M3mediumGPT-5.5nonevsGLM 5.3 FlashlowEmber-1maxvsGPT-5.6 SolnoneEmber-1maxvsGrok 4.7highEmber-1maxvsSolar Pro 4lowEmber-1maxvsQwen3.5-FlashnoneGPT-5.5nonevsQwen3.7 FlashmediumEmber-1maxvsGLM 5.3 FlashlowMiniMax M3mediumvsGPT-5.5noneGPT-5.5nonevsGrok 4.7highLongCat 2.0lowvsGPT-5.5none