- क्रमांक
- #158
- एकूण आउटपुट टोकन्स
- 110,125
- प्रतिसाद वेळ (सरासरी)
- 56.77s
- एकूण खर्च
- $1.798
Ember-1 (high) vs GLM 5.1 (medium)
Ember-1 (high) average score मध्ये पुढे आहे: 7.1 vs 7.0. GLM 5.1 (medium) चा benchmark खर्च कमी आहे: $1.053 vs $1.798. Ember-1 (high) वेगवान आहे: 56.77s vs 58.80s, pass rates 71.2% vs 65.2%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #164
- एकूण आउटपुट टोकन्स
- 215,889
- प्रतिसाद वेळ (सरासरी)
- 58.80s
- एकूण खर्च
- $1.053
शिफारस केलेले मॉडेल
GLM 5.1 (medium)
Its score stays close to the best score here (7.0 vs 7.1), while costing about 1.7x less than Ember-1 (high).
तपशीलवार तुलना
| मेट्रिक | Ember-1 Ember-1 high | GLM 5.1 GLM 5.1 medium |
|---|---|---|
| स्कोअर | 7.1 | 7.0 |
| क्रमांक | #158 | #164 |
| विश्वसनीयता | 8.0 | 8.1 |
| सुसंगतता | 7.3 | 8.4 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 71.2% | 65.2% |
| अस्थिर चाचण्या | 7 | 4 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 14.981 | 6.923 |
| एकूण खर्च | $1.798 | $1.053 |
| इनपुट किंमत | $3.000 / 1M | $1.400 / 1M |
| आउटपुट किंमत | $15.000 / 1M | $4.400 / 1M |
| एकूण इनपुट टोकन्स | 48,577 | 82,592 |
| आउटपुट टोकन्स | 7,345 | 16,089 |
| रिझनिंग टोकन्स | 102,780 | 199,800 |
| प्रतिसाद वेळ (सरासरी) | 56.77s | 58.80s |
| प्रतिसाद वेळ (कमाल) | 255.06s | 308.75s |
| प्रतिसाद वेळ (एकूण) | 1248.88s | 1234.72s |
| पॅरामीटर्स | ~2.8T एकूण (~104B सक्रिय) | 744B एकूण (40B सक्रिय) |
| उपलब्धता | बंद स्रोत | मुक्त स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#158 Ember-1
high- खर्च
- $0.038
- वेळ
- 55.1s
- टोकन्स
- 2,671 tok
#164 GLM 5.1
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- खर्च
- $0.000
- वेळ
- 300.0s
- टोकन्स
- 0 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
GPT-5.5nonevsGLM 5.1mediumSpace Bunny AlphahighvsGLM 5.1mediumEmber-1highvsGrok 4.3mediumEmber-1highvsGPT-5.6 SolnoneEmber-1highvsGPT-6 LunalowGPT-6 LunalowvsGLM 5.1mediumDeepSeek V3.2mediumvsEmber-1highGPT-5.6 SolnonevsGLM 5.1mediumEmber-1highvsGPT-5.5noneEmber-1highvsMercury 2mediumEmber-1highvsGrok 4.20mediumClaude Fable 5.1lowvsGLM 5.1medium