नेविगेशन
Advertise here

Ember-1 (low) vs GPT-5.6 Luna (medium)

average score लगभग बराबर है: 7.5 vs 7.4. GPT-5.6 Luna (medium) की benchmark लागत कम है: $0.072 vs $0.662. GPT-5.6 Luna (medium) तेज है: 7.43s vs 30.98s, pass rates 66.7% vs 62.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#128
कुल आउटपुट टोकन
37,467
प्रतिक्रिया समय (औसत)
30.98s
कुल लागत
$0.662
रैंक
#140
कुल आउटपुट टोकन
44,525
प्रतिक्रिया समय (औसत)
7.43s
कुल लागत
$0.072
अनुशंसित मॉडल GPT-5.6 Luna (medium)

It has the best score here (7.4), while costing about 9.3x less than Ember-1 (low).

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 low रिलीज़: 2026-09-28 GPT-5.6 Luna GPT-5.6 Luna medium रिलीज़: 2026-07-09
स्कोर 7.5 7.4
रैंक #128 #140
विश्वसनीयता 8.1 10.0
संगति 8.5 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 66.7% 62.1%
अस्थिर टेस्ट 4 2
कुल रन 66 66
प्रति परिणाम लागत 5.085 2.601
कुल लागत $0.662 $0.072
इनपुट कीमत $3.000 / 1M $0.200 / 1M
आउटपुट कीमत $15.000 / 1M $1.200 / 1M
कुल इनपुट टोकन 33,011 89,685
आउटपुट टोकन 4,780 5,701
रीजनिंग टोकन 32,687 38,824
प्रतिक्रिया समय (औसत) 30.98s 7.43s
प्रतिक्रिया समय (अधिकतम) 93.10s 29.85s
प्रतिक्रिया समय (कुल) 681.50s 163.54s
पैरामीटर ~2.8T कुल (~104B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#128 Ember-1

low
लागत
$0.016
समय
24.2s
टोकन
1,165 tok

#140 GPT-5.6 Luna

medium
लागत
$0.014
समय
14.6s
टोकन
2,362 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 10.0 10.0 100.0% 0 37.91s 8,097 2,518 13,142
GPT-5.6 Luna 5.4 7.2 44.4% 1 10.38s 7,302 564 9,928

त्वरित तुलना

तुलना जोड़ी बदलें