नेविगेशन
Advertise here

Ember-1 (high) vs GPT-5.5

Ember-1 (high) average score में आगे है: 7.1 vs 7.0. GPT-5.5 की benchmark लागत कम है: $0.544 vs $1.798. GPT-5.5 तेज है: 2.35s vs 56.77s, pass rates 71.2% vs 59.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#158
कुल आउटपुट टोकन
110,125
प्रतिक्रिया समय (औसत)
56.77s
कुल लागत
$1.798
रैंक
#165
कुल आउटपुट टोकन
4,915
प्रतिक्रिया समय (औसत)
2.35s
कुल लागत
$0.544
अनुशंसित मॉडल GPT-5.5

Its score stays close to the best score here (7.0 vs 7.1), while costing about 3.3x less than Ember-1 (high).

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 high रिलीज़: 2026-09-28 GPT-5.5 GPT-5.5 none रिलीज़: 2026-04-24
स्कोर 7.1 7.0
रैंक #158 #165
विश्वसनीयता 8.0 10.0
संगति 7.3 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 71.2% 59.1%
अस्थिर टेस्ट 7 2
कुल रन 66 66
प्रति परिणाम लागत 14.981 4.533
कुल लागत $1.798 $0.544
इनपुट कीमत $3.000 / 1M $5.000 / 1M
आउटपुट कीमत $15.000 / 1M $30.000 / 1M
कुल इनपुट टोकन 48,577 79,294
आउटपुट टोकन 7,345 4,915
रीजनिंग टोकन 102,780 0
प्रतिक्रिया समय (औसत) 56.77s 2.35s
प्रतिक्रिया समय (अधिकतम) 255.06s 12.24s
प्रतिक्रिया समय (कुल) 1248.88s 51.78s
पैरामीटर ~2.8T कुल (~104B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#158 Ember-1

high
लागत
$0.038
समय
55.1s
टोकन
2,671 tok

#165 GPT-5.5

none
लागत
$0.090
समय
54.3s
टोकन
3,063 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 8.2 7.2 88.9% 1 72.23s 7,144 1,281 23,093
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

त्वरित तुलना

तुलना जोड़ी बदलें