नेविगेशन
Advertise here

Ember-1 (max) vs GPT-5.5

average score लगभग बराबर है: 6.7 vs 6.6. GPT-5.5 की benchmark लागत कम है: $1.212 vs $3.264. GPT-5.5 तेज है: 4.75s vs 97.34s, pass rates 59.4% vs 56.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#181
कुल आउटपुट टोकन
186,901
प्रतिक्रिया समय (औसत)
97.34s
कुल लागत
$3.264
रैंक
#185
कुल आउटपुट टोकन
6,197
प्रतिक्रिया समय (औसत)
4.75s
कुल लागत
$1.212
अनुशंसित मॉडल GPT-5.5

It has the best score here (6.6), while costing about 2.7x less than Ember-1 (max).

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 max रिलीज़: 2026-09-28 GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24
स्कोर 6.7 6.6
रैंक #181 #185
विश्वसनीयता 8.3 10.0
संगति 7.8 9.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 59.4% 56.5%
अस्थिर टेस्ट 6 2
कुल रन 69 69
प्रति परिणाम लागत 29.671 10.096
कुल लागत $3.264 $1.212
इनपुट कीमत $3.000 / 1M $5.000 / 1M
आउटपुट कीमत $15.000 / 1M $30.000 / 1M
कुल इनपुट टोकन 153,399 205,108
आउटपुट टोकन 7,803 6,197
रीजनिंग टोकन 179,098 0
प्रतिक्रिया समय (औसत) 97.34s 4.75s
प्रतिक्रिया समय (अधिकतम) 587.08s 57.53s
प्रतिक्रिया समय (कुल) 2238.73s 109.31s
पैरामीटर ~2.8T कुल (~104B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#181 Ember-1

max
लागत
$0.163
समय
229.4s
टोकन
11,002 tok

#185 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 5.2 4.4 55.6% 2 105.09s 3,362 1,149 27,957
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

त्वरित तुलना

तुलना जोड़ी बदलें