नेव्हिगेशन
Advertise here

Ember-1 (max) vs GPT-5.5

average score जवळपास समान आहे: 6.7 vs 6.6. GPT-5.5 चा benchmark खर्च कमी आहे: $1.212 vs $3.264. GPT-5.5 वेगवान आहे: 4.75s vs 97.34s, pass rates 59.4% vs 56.5%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#181
एकूण आउटपुट टोकन्स
186,901
प्रतिसाद वेळ (सरासरी)
97.34s
एकूण खर्च
$3.264
क्रमांक
#185
एकूण आउटपुट टोकन्स
6,197
प्रतिसाद वेळ (सरासरी)
4.75s
एकूण खर्च
$1.212
शिफारस केलेले मॉडेल GPT-5.5

It has the best score here (6.6), while costing about 2.7x less than Ember-1 (max).

तपशीलवार तुलना

मेट्रिक Ember-1 Ember-1 max प्रकाशन: 2026-09-28 GPT-5.5 GPT-5.5 none प्रकाशन: 2026-04-24
स्कोअर 6.7 6.6
क्रमांक #181 #185
विश्वसनीयता 8.3 10.0
सुसंगतता 7.8 9.3
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 59.4% 56.5%
अस्थिर चाचण्या 6 2
एकूण रन 69 69
प्रति निकाल खर्च 29.671 10.096
एकूण खर्च $3.264 $1.212
इनपुट किंमत $3.000 / 1M $5.000 / 1M
आउटपुट किंमत $15.000 / 1M $30.000 / 1M
एकूण इनपुट टोकन्स 153,399 205,108
आउटपुट टोकन्स 7,803 6,197
रिझनिंग टोकन्स 179,098 0
प्रतिसाद वेळ (सरासरी) 97.34s 4.75s
प्रतिसाद वेळ (कमाल) 587.08s 57.53s
प्रतिसाद वेळ (एकूण) 2238.73s 109.31s
पॅरामीटर्स ~2.8T एकूण (~104B सक्रिय) ~1.5T एकूण (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#181 Ember-1

max
खर्च
$0.163
वेळ
229.4s
टोकन्स
11,002 tok

#185 GPT-5.5

none
खर्च
$0.090
वेळ
54.3s
टोकन्स
3,063 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Ember-1 5.2 4.4 55.6% 2 105.09s 3,362 1,149 27,957
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

झटपट तुलना

तुलना जोडी बदला