नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Ember-1 (high) vs GPT-5.6 Sol

average score लगभग बराबर है: 7.1 vs 7.0. GPT-5.6 Sol की benchmark लागत कम है: $0.201 vs $1.798. GPT-5.6 Sol तेज है: 2.17s vs 56.77s, pass rates 71.2% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#158
कुल आउटपुट टोकन
110,125
प्रतिक्रिया समय (औसत)
56.77s
कुल लागत
$1.798
रैंक
#160
कुल आउटपुट टोकन
4,357
प्रतिक्रिया समय (औसत)
2.17s
कुल लागत
$0.201
अनुशंसित मॉडल GPT-5.6 Sol

It has the best score here (7.0), while costing about 9.0x less than Ember-1 (high).

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 high रिलीज़: 2026-09-28 GPT-5.6 Sol GPT-5.6 Sol none रिलीज़: 2026-07-09
स्कोर 7.1 7.0
रैंक #158 #160
विश्वसनीयता 8.0 10.0
संगति 7.3 9.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 71.2% 63.6%
अस्थिर टेस्ट 7 3
कुल रन 66 66
प्रति परिणाम लागत 14.981 4.365
कुल लागत $1.798 $0.201
इनपुट कीमत $3.000 / 1M $2.000 / 1M
आउटपुट कीमत $15.000 / 1M $10.000 / 1M
कुल इनपुट टोकन 48,577 78,602
आउटपुट टोकन 7,345 4,357
रीजनिंग टोकन 102,780 0
प्रतिक्रिया समय (औसत) 56.77s 2.17s
प्रतिक्रिया समय (अधिकतम) 255.06s 12.81s
प्रतिक्रिया समय (कुल) 1248.88s 47.66s
पैरामीटर ~2.8T कुल (~104B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#158 Ember-1

high
लागत
$0.038
समय
55.1s
टोकन
2,671 tok

#160 GPT-5.6 Sol

none
लागत
$0.116
समय
78.7s
टोकन
3,944 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 8.2 7.2 88.9% 1 72.23s 7,144 1,281 23,093
GPT-5.6 Sol 5.5 10.0 33.3% 0 1.39s 7,302 390 0

त्वरित तुलना

तुलना जोड़ी बदलें