नेव्हिगेशन
Advertise here

Ember-1 (max) vs GPT-5.4 Mini

average score जवळपास समान आहे: 5.9 vs 5.9. GPT-5.4 Mini चा benchmark खर्च कमी आहे: $0.095 vs $2.792. GPT-5.4 Mini वेगवान आहे: 1.58s vs 98.92s, pass rates 57.6% vs 31.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-09-28

तुलना केलेली मॉडेल्स

क्रमांक
#248
एकूण आउटपुट टोकन्स
180,806
प्रतिसाद वेळ (सरासरी)
98.92s
एकूण खर्च
$2.792
क्रमांक
#251
एकूण आउटपुट टोकन्स
7,898
प्रतिसाद वेळ (सरासरी)
1.58s
एकूण खर्च
$0.095
शिफारस केलेले मॉडेल GPT-5.4 Mini

It has the best score here (5.9), while costing about 29.4x less than Ember-1 (max).

तपशीलवार तुलना

मेट्रिक Ember-1 Ember-1 max प्रकाशन: 2026-09-28 GPT-5.4 Mini GPT-5.4 Mini none प्रकाशन: 2026-03-17
स्कोअर 5.9 5.9
क्रमांक #248 #251
विश्वसनीयता 7.5 10.0
सुसंगतता 7.7 9.3
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 57.6% 31.8%
अस्थिर चाचण्या 6 2
एकूण रन 66 66
प्रति निकाल खर्च 27.915 1.581
एकूण खर्च $2.792 $0.095
इनपुट किंमत $3.000 / 1M $0.750 / 1M
आउटपुट किंमत $15.000 / 1M $4.500 / 1M
एकूण इनपुट टोकन्स 26,449 79,076
आउटपुट टोकन्स 4,183 7,898
रिझनिंग टोकन्स 176,623 0
प्रतिसाद वेळ (सरासरी) 98.92s 1.58s
प्रतिसाद वेळ (कमाल) 587.08s 9.92s
प्रतिसाद वेळ (एकूण) 2176.20s 34.86s
पॅरामीटर्स ~2.8T एकूण (~104B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#248 Ember-1

max
खर्च
$0.163
वेळ
229.4s
टोकन्स
11,002 tok

#251 GPT-5.4 Mini

none
खर्च
$0.010
वेळ
11.7s
टोकन्स
2,151 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Ember-1 5.2 4.4 55.6% 2 105.09s 3,362 1,149 27,957
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0

झटपट तुलना

तुलना जोडी बदला