- क्रमांक
- #158
- एकूण आउटपुट टोकन्स
- 110,125
- प्रतिसाद वेळ (सरासरी)
- 56.77s
- एकूण खर्च
- $1.798
Ember-1 (high) vs Grok 4.3 (medium)
average score जवळपास समान आहे: 7.1 vs 7.0. Grok 4.3 (medium) चा benchmark खर्च कमी आहे: $0.741 vs $1.798. Grok 4.3 (medium) वेगवान आहे: 44.21s vs 56.77s, pass rates 71.2% vs 66.7%.
तुलना केलेली मॉडेल्स
- क्रमांक
- #159
- एकूण आउटपुट टोकन्स
- 225,904
- प्रतिसाद वेळ (सरासरी)
- 44.21s
- एकूण खर्च
- $0.741
शिफारस केलेले मॉडेल
Grok 4.3 (medium)
It has the best score here (7.0), while costing about 2.4x less than Ember-1 (high).
तपशीलवार तुलना
| मेट्रिक | Ember-1 Ember-1 high | Grok 4.3 Grok 4.3 medium |
|---|---|---|
| स्कोअर | 7.1 | 7.0 |
| क्रमांक | #158 | #159 |
| विश्वसनीयता | 8.0 | 10.0 |
| सुसंगतता | 7.3 | 8.2 |
| प्रयत्न | 66/66 | 66/66 |
| बरोबर चाचण्या | ||
| प्रति प्रयत्न पास दर | 71.2% | 66.7% |
| अस्थिर चाचण्या | 7 | 5 |
| एकूण रन | 66 | 66 |
| प्रति निकाल खर्च | 14.981 | 6.168 |
| एकूण खर्च | $1.798 | $0.741 |
| इनपुट किंमत | $3.000 / 1M | $1.250 / 1M |
| आउटपुट किंमत | $15.000 / 1M | $2.500 / 1M |
| एकूण इनपुट टोकन्स | 48,577 | 140,244 |
| आउटपुट टोकन्स | 7,345 | 13,739 |
| रिझनिंग टोकन्स | 102,780 | 212,165 |
| प्रतिसाद वेळ (सरासरी) | 56.77s | 44.21s |
| प्रतिसाद वेळ (कमाल) | 255.06s | 216.69s |
| प्रतिसाद वेळ (एकूण) | 1248.88s | 972.64s |
| पॅरामीटर्स | ~2.8T एकूण (~104B सक्रिय) | ~1.5T एकूण (~150B सक्रिय) |
| उपलब्धता | बंद स्रोत | बंद स्रोत |
मॉडेल जनरेशन शोकेस
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#158 Ember-1
high- खर्च
- $0.038
- वेळ
- 55.1s
- टोकन्स
- 2,671 tok
#159 SpaceXAI: Grok 4.3
medium- खर्च
- $0.009
- वेळ
- 19.0s
- टोकन्स
- 3,661 tok
स्कोअरनुसार शीर्ष मॉडेल्स
स्कोअर विरुद्ध एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
श्रेणीवार तपशील
झटपट तुलना
तुलना जोडी बदला
GPT-5.6 SolnonevsGrok 4.3mediumGPT-6 LunalowvsGrok 4.3mediumEmber-1highvsGPT-5.6 SolnoneEmber-1highvsGPT-6 LunalowSpace Bunny AlphahighvsGrok 4.3mediumMercury 2.5highvsGrok 4.3mediumDeepSeek V3.2mediumvsEmber-1highGPT-5.5nonevsGrok 4.3mediumEmber-1highvsGLM 5.1mediumEmber-1highvsGPT-5.5noneEmber-1highvsMercury 2mediumSolar Pro 4highvsGrok 4.3medium