नेव्हिगेशन
Advertise here

Ember-1 (low) vs GPT-5.2 Chat

average score जवळपास समान आहे: 7.0 vs 7.0. GPT-5.2 Chat चा benchmark खर्च कमी आहे: $0.594 vs $1.488. GPT-5.2 Chat वेगवान आहे: 7.43s vs 34.90s, pass rates 65.2% vs 66.7%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#157
एकूण आउटपुट टोकन्स
56,766
प्रतिसाद वेळ (सरासरी)
34.90s
एकूण खर्च
$1.488
क्रमांक
#153
एकूण आउटपुट टोकन्स
29,742
प्रतिसाद वेळ (सरासरी)
7.43s
एकूण खर्च
$0.594
शिफारस केलेले मॉडेल GPT-5.2 Chat

It has the best score here (7.0), while costing about 2.5x less than Ember-1 (low).

तपशीलवार तुलना

मेट्रिक Ember-1 Ember-1 low प्रकाशन: 2026-09-28 GPT-5.2 Chat GPT-5.2 Chat none प्रकाशन: 2025-12-11
स्कोअर 7.0 7.0
क्रमांक #157 #153
विश्वसनीयता 8.8 10.0
सुसंगतता 8.2 8.7
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 65.2% 66.7%
अस्थिर चाचण्या 5 4
एकूण रन 69 69
प्रति निकाल खर्च 11.441 4.564
एकूण खर्च $1.488 $0.594
इनपुट किंमत $3.000 / 1M $1.750 / 1M
आउटपुट किंमत $15.000 / 1M $14.000 / 1M
एकूण इनपुट टोकन्स 211,908 101,104
आउटपुट टोकन्स 14,158 29,742
रिझनिंग टोकन्स 42,608 0
प्रतिसाद वेळ (सरासरी) 34.90s 7.43s
प्रतिसाद वेळ (कमाल) 121.29s 38.52s
प्रतिसाद वेळ (एकूण) 802.79s 163.35s
पॅरामीटर्स ~2.8T एकूण (~104B सक्रिय) ~400B एकूण (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#157 Ember-1

low
खर्च
$0.016
वेळ
24.2s
टोकन्स
1,165 tok

#153 GPT-5.2 Chat

none
खर्च
$0.010
वेळ
15.3s
टोकन्स
797 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Ember-1 10.0 10.0 100.0% 0 37.91s 8,097 2,518 13,142
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

झटपट तुलना

तुलना जोडी बदला