नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Ember-1 vs GPT-5.6 Luna

average score लगभग बराबर है: 5.4 vs 5.3. GPT-5.6 Luna की benchmark लागत कम है: $0.042 vs $0.786. GPT-5.6 Luna तेज है: 3.78s vs 22.65s, pass rates 43.5% vs 34.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-07

तुलना किए गए मॉडल

रैंक
#295
कुल आउटपुट टोकन
11,832
प्रतिक्रिया समय (औसत)
22.65s
कुल लागत
$0.786
रैंक
#297
कुल आउटपुट टोकन
8,000
प्रतिक्रिया समय (औसत)
3.78s
कुल लागत
$0.042
अनुशंसित मॉडल GPT-5.6 Luna

It has the best score here (5.3), while costing about 18.9x less than Ember-1.

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 none रिलीज़: 2026-09-28 GPT-5.6 Luna GPT-5.6 Luna none रिलीज़: 2026-07-09
स्कोर 5.4 5.3
रैंक #295 #297
विश्वसनीयता 8.8 10.0
संगति 8.6 8.8
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 43.5% 34.8%
अस्थिर टेस्ट 4 3
कुल रन 69 69
प्रति परिणाम लागत 9.817 2.814
कुल लागत $0.786 $0.042
इनपुट कीमत $3.000 / 1M $0.200 / 1M
आउटपुट कीमत $15.000 / 1M $1.200 / 1M
कैश पढ़ने की कीमत $0.300 / 1M $0.020 / 1M
कैश लिखने की कीमत लागू नहीं $0.250 / 1M
कुल इनपुट टोकन 202,617 230,744
आउटपुट टोकन 11,832 8,000
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 22.65s 3.78s
प्रतिक्रिया समय (अधिकतम) 93.12s 53.77s
प्रतिक्रिया समय (कुल) 520.91s 86.83s
पैरामीटर ~2.8T कुल (~104B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#295 Ember-1

none
लागत
$0.156
समय
224.6s
टोकन
10,555 tok

#297 GPT-5.6 Luna

none
लागत
$0.016
समय
15.8s
टोकन
2,685 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 5.5 10.0 33.3% 0 1.94s 7,485 393 0
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0

तुलना जोड़ी बदलें