- क्रमांक
- #181
- एकूण आउटपुट टोकन्स
- 186,901
- प्रतिसाद वेळ (सरासरी)
- 97.34s
- एकूण खर्च
- $3.264
Ember-1 (max) vs GPT-5.5
average score जवळपास समान आहे: 6.7 vs 6.6. GPT-5.5 चा benchmark खर्च कमी आहे: $1.212 vs $3.264. GPT-5.5 वेगवान आहे: 4.75s vs 97.34s, pass rates 59.4% vs 56.5%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #185
- एकूण आउटपुट टोकन्स
- 6,197
- प्रतिसाद वेळ (सरासरी)
- 4.75s
- एकूण खर्च
- $1.212
शिफारस केलेले मॉडेल
GPT-5.5
It has the best score here (6.6), while costing about 2.7x less than Ember-1 (max).
तपशीलवार तुलना
| मेट्रिक | Ember-1 Ember-1 max | GPT-5.5 GPT-5.5 none |
|---|---|---|
| स्कोअर | 6.7 | 6.6 |
| क्रमांक | #181 | #185 |
| विश्वसनीयता | 8.3 | 10.0 |
| सुसंगतता | 7.8 | 9.3 |
| प्रयत्न | 69/69 | 69/69 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 59.4% | 56.5% |
| अस्थिर चाचण्या | 6 | 2 |
| एकूण रन | 69 | 69 |
| प्रति निकाल खर्च | 29.671 | 10.096 |
| एकूण खर्च | $3.264 | $1.212 |
| इनपुट किंमत | $3.000 / 1M | $5.000 / 1M |
| आउटपुट किंमत | $15.000 / 1M | $30.000 / 1M |
| एकूण इनपुट टोकन्स | 153,399 | 205,108 |
| आउटपुट टोकन्स | 7,803 | 6,197 |
| रिझनिंग टोकन्स | 179,098 | 0 |
| प्रतिसाद वेळ (सरासरी) | 97.34s | 4.75s |
| प्रतिसाद वेळ (कमाल) | 587.08s | 57.53s |
| प्रतिसाद वेळ (एकूण) | 2238.73s | 109.31s |
| पॅरामीटर्स | ~2.8T एकूण (~104B सक्रिय) | ~1.5T एकूण (~100B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#181 Ember-1
max- खर्च
- $0.163
- वेळ
- 229.4s
- टोकन्स
- 11,002 tok
#185 GPT-5.5
none- खर्च
- $0.090
- वेळ
- 54.3s
- टोकन्स
- 3,063 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
Ember-1maxvsGPT 5.3 ChatnoneEmber-1maxvsMiniMax M3mediumGPT-5.5nonevsGLM 5.3 FlashlowEmber-1maxvsGPT-5.6 SolnoneEmber-1maxvsGrok 4.7highEmber-1maxvsSolar Pro 4lowEmber-1maxvsQwen3.5-FlashnoneGPT-5.5nonevsQwen3.7 FlashmediumEmber-1maxvsGLM 5.3 FlashlowMiniMax M3mediumvsGPT-5.5noneGPT-5.5nonevsGrok 4.7highLongCat 2.0lowvsGPT-5.5none