नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Ember-1 (max) vs GPT-5.4 Mini

average score लगभग बराबर है: 5.9 vs 5.9. GPT-5.4 Mini की benchmark लागत कम है: $0.095 vs $2.792. GPT-5.4 Mini तेज है: 1.58s vs 98.92s, pass rates 57.6% vs 31.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#248
कुल आउटपुट टोकन
180,806
प्रतिक्रिया समय (औसत)
98.92s
कुल लागत
$2.792
रैंक
#251
कुल आउटपुट टोकन
7,898
प्रतिक्रिया समय (औसत)
1.58s
कुल लागत
$0.095
अनुशंसित मॉडल GPT-5.4 Mini

It has the best score here (5.9), while costing about 29.4x less than Ember-1 (max).

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 max रिलीज़: 2026-09-28 GPT-5.4 Mini GPT-5.4 Mini none रिलीज़: 2026-03-17
स्कोर 5.9 5.9
रैंक #248 #251
विश्वसनीयता 7.5 10.0
संगति 7.7 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 57.6% 31.8%
अस्थिर टेस्ट 6 2
कुल रन 66 66
प्रति परिणाम लागत 27.915 1.581
कुल लागत $2.792 $0.095
इनपुट कीमत $3.000 / 1M $0.750 / 1M
आउटपुट कीमत $15.000 / 1M $4.500 / 1M
कुल इनपुट टोकन 26,449 79,076
आउटपुट टोकन 4,183 7,898
रीजनिंग टोकन 176,623 0
प्रतिक्रिया समय (औसत) 98.92s 1.58s
प्रतिक्रिया समय (अधिकतम) 587.08s 9.92s
प्रतिक्रिया समय (कुल) 2176.20s 34.86s
पैरामीटर ~2.8T कुल (~104B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#248 Ember-1

max
लागत
$0.163
समय
229.4s
टोकन
11,002 tok

#251 GPT-5.4 Mini

none
लागत
$0.010
समय
11.7s
टोकन
2,151 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 5.2 4.4 55.6% 2 105.09s 3,362 1,149 27,957
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0

त्वरित तुलना

तुलना जोड़ी बदलें