नेव्हिगेशन
Advertise here

Ember-1 (high) vs GPT-5.5

Ember-1 (high) average score मध्ये पुढे आहे: 7.1 vs 7.0. GPT-5.5 चा benchmark खर्च कमी आहे: $0.544 vs $1.798. GPT-5.5 वेगवान आहे: 2.35s vs 56.77s, pass rates 71.2% vs 59.1%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-28

तुलना केलेली मॉडेल्स

क्रमांक
#158
एकूण आउटपुट टोकन्स
110,125
प्रतिसाद वेळ (सरासरी)
56.77s
एकूण खर्च
$1.798
क्रमांक
#165
एकूण आउटपुट टोकन्स
4,915
प्रतिसाद वेळ (सरासरी)
2.35s
एकूण खर्च
$0.544
शिफारस केलेले मॉडेल GPT-5.5

Its score stays close to the best score here (7.0 vs 7.1), while costing about 3.3x less than Ember-1 (high).

तपशीलवार तुलना

मेट्रिक Ember-1 Ember-1 high प्रकाशन: 2026-09-28 GPT-5.5 GPT-5.5 none प्रकाशन: 2026-04-24
स्कोअर 7.1 7.0
क्रमांक #158 #165
विश्वसनीयता 8.0 10.0
सुसंगतता 7.3 9.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.2% 59.1%
अस्थिर चाचण्या 7 2
एकूण रन 66 66
प्रति निकाल खर्च 14.981 4.533
एकूण खर्च $1.798 $0.544
इनपुट किंमत $3.000 / 1M $5.000 / 1M
आउटपुट किंमत $15.000 / 1M $30.000 / 1M
एकूण इनपुट टोकन्स 48,577 79,294
आउटपुट टोकन्स 7,345 4,915
रिझनिंग टोकन्स 102,780 0
प्रतिसाद वेळ (सरासरी) 56.77s 2.35s
प्रतिसाद वेळ (कमाल) 255.06s 12.24s
प्रतिसाद वेळ (एकूण) 1248.88s 51.78s
पॅरामीटर्स ~2.8T एकूण (~104B सक्रिय) ~1.5T एकूण (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#158 Ember-1

high
खर्च
$0.038
वेळ
55.1s
टोकन्स
2,671 tok

#165 GPT-5.5

none
खर्च
$0.090
वेळ
54.3s
टोकन्स
3,063 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Ember-1 8.2 7.2 88.9% 1 72.23s 7,144 1,281 23,093
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

झटपट तुलना

तुलना जोडी बदला