नेव्हिगेशन
Advertise here

Ember-1 (high) vs GPT-6 Luna (high)

GPT-6 Luna (high) average score मध्ये पुढे आहे: 8.3 vs 7.1. GPT-6 Luna (high) चा benchmark खर्च कमी आहे: $0.054 vs $1.798. GPT-6 Luna (high) वेगवान आहे: 17.53s vs 56.77s, pass rates 71.2% vs 75.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-28

तुलना केलेली मॉडेल्स

क्रमांक
#158
एकूण आउटपुट टोकन्स
110,125
प्रतिसाद वेळ (सरासरी)
56.77s
एकूण खर्च
$1.798
क्रमांक
#73
एकूण आउटपुट टोकन्स
91,405
प्रतिसाद वेळ (सरासरी)
17.53s
एकूण खर्च
$0.054
शिफारस केलेले मॉडेल GPT-6 Luna (high)

It has the best score here (8.3), while costing about 33.4x less than Ember-1 (high).

तपशीलवार तुलना

मेट्रिक Ember-1 Ember-1 high प्रकाशन: 2026-09-28 GPT-6 Luna GPT-6 Luna high प्रकाशन: 2026-09-23
स्कोअर 7.1 8.3
क्रमांक #158 #73
विश्वसनीयता 8.0 10.0
सुसंगतता 7.3 9.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.2% 75.8%
अस्थिर चाचण्या 7 3
एकूण रन 66 66
प्रति निकाल खर्च 14.981 0.359
एकूण खर्च $1.798 $0.054
इनपुट किंमत $3.000 / 1M $0.100 / 1M
आउटपुट किंमत $15.000 / 1M $0.500 / 1M
एकूण इनपुट टोकन्स 48,577 80,441
आउटपुट टोकन्स 7,345 4,761
रिझनिंग टोकन्स 102,780 86,644
प्रतिसाद वेळ (सरासरी) 56.77s 17.53s
प्रतिसाद वेळ (कमाल) 255.06s 106.93s
प्रतिसाद वेळ (एकूण) 1248.88s 385.74s
पॅरामीटर्स ~2.8T एकूण (~104B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#158 Ember-1

high
खर्च
$0.038
वेळ
55.1s
टोकन्स
2,671 tok

#73 GPT-6 Luna

high
खर्च
$0.003
वेळ
49.2s
टोकन्स
5,231 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Ember-1 8.2 7.2 88.9% 1 72.23s 7,144 1,281 23,093
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

झटपट तुलना

तुलना जोडी बदला