- क्रमांक
- #158
- एकूण आउटपुट टोकन्स
- 110,125
- प्रतिसाद वेळ (सरासरी)
- 56.77s
- एकूण खर्च
- $1.798
Ember-1 (high) vs GPT-5.5
Ember-1 (high) average score मध्ये पुढे आहे: 7.1 vs 7.0. GPT-5.5 चा benchmark खर्च कमी आहे: $0.544 vs $1.798. GPT-5.5 वेगवान आहे: 2.35s vs 56.77s, pass rates 71.2% vs 59.1%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #165
- एकूण आउटपुट टोकन्स
- 4,915
- प्रतिसाद वेळ (सरासरी)
- 2.35s
- एकूण खर्च
- $0.544
शिफारस केलेले मॉडेल
GPT-5.5
Its score stays close to the best score here (7.0 vs 7.1), while costing about 3.3x less than Ember-1 (high).
तपशीलवार तुलना
| मेट्रिक | Ember-1 Ember-1 high | GPT-5.5 GPT-5.5 none |
|---|---|---|
| स्कोअर | 7.1 | 7.0 |
| क्रमांक | #158 | #165 |
| विश्वसनीयता | 8.0 | 10.0 |
| सुसंगतता | 7.3 | 9.2 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 71.2% | 59.1% |
| अस्थिर चाचण्या | 7 | 2 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 14.981 | 4.533 |
| एकूण खर्च | $1.798 | $0.544 |
| इनपुट किंमत | $3.000 / 1M | $5.000 / 1M |
| आउटपुट किंमत | $15.000 / 1M | $30.000 / 1M |
| एकूण इनपुट टोकन्स | 48,577 | 79,294 |
| आउटपुट टोकन्स | 7,345 | 4,915 |
| रिझनिंग टोकन्स | 102,780 | 0 |
| प्रतिसाद वेळ (सरासरी) | 56.77s | 2.35s |
| प्रतिसाद वेळ (कमाल) | 255.06s | 12.24s |
| प्रतिसाद वेळ (एकूण) | 1248.88s | 51.78s |
| पॅरामीटर्स | ~2.8T एकूण (~104B सक्रिय) | ~1.5T एकूण (~100B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#158 Ember-1
high- खर्च
- $0.038
- वेळ
- 55.1s
- टोकन्स
- 2,671 tok
#165 GPT-5.5
none- खर्च
- $0.090
- वेळ
- 54.3s
- टोकन्स
- 3,063 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
Mercury 2mediumvsGPT-5.5noneGPT-5.5nonevsGLM 5.1mediumGPT-5.5nonevsGrok 4.20mediumGPT-5.5nonevsSpace Bunny AlphahighEmber-1highvsGrok 4.3mediumEmber-1highvsGPT-5.6 SolnoneEmber-1highvsGPT-6 LunalowDeepSeek V3.2mediumvsGPT-5.5noneSeed-2.0-MinimediumvsGPT-5.5noneKimi K2.5mediumvsGPT-5.5noneDeepSeek V3.2mediumvsEmber-1highGPT-5.5nonevsGrok 4.3medium