नेविगेशन
Advertise here

Ember-1 (high) vs GPT-6 Luna (low)

average score लगभग बराबर है: 7.1 vs 7.0. GPT-6 Luna (low) की benchmark लागत कम है: $0.020 vs $1.798. GPT-6 Luna (low) तेज है: 21.96s vs 56.77s, pass rates 71.2% vs 62.1%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#158
कुल आउटपुट टोकन
110,125
प्रतिक्रिया समय (औसत)
56.77s
कुल लागत
$1.798
रैंक
#161
कुल आउटपुट टोकन
22,605
प्रतिक्रिया समय (औसत)
21.96s
कुल लागत
$0.020
अनुशंसित मॉडल GPT-6 Luna (low)

It has the best score here (7.0), while costing about 93.1x less than Ember-1 (high).

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 high रिलीज़: 2026-09-28 GPT-6 Luna GPT-6 Luna low रिलीज़: 2026-09-23
स्कोर 7.1 7.0
रैंक #158 #161
विश्वसनीयता 8.0 9.6
संगति 7.3 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 71.2% 62.1%
अस्थिर टेस्ट 7 4
कुल रन 66 66
प्रति परिणाम लागत 14.981 0.176
कुल लागत $1.798 $0.020
इनपुट कीमत $3.000 / 1M $0.100 / 1M
आउटपुट कीमत $15.000 / 1M $0.500 / 1M
कुल इनपुट टोकन 48,577 80,159
आउटपुट टोकन 7,345 4,623
रीजनिंग टोकन 102,780 17,982
प्रतिक्रिया समय (औसत) 56.77s 21.96s
प्रतिक्रिया समय (अधिकतम) 255.06s 89.37s
प्रतिक्रिया समय (कुल) 1248.88s 483.19s
पैरामीटर ~2.8T कुल (~104B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#158 Ember-1

high
लागत
$0.038
समय
55.1s
टोकन
2,671 tok

#161 GPT-6 Luna

low
लागत
$0.002
समय
19.2s
टोकन
2,598 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 8.2 7.2 88.9% 1 72.23s 7,144 1,281 23,093
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

त्वरित तुलना

तुलना जोड़ी बदलें