नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Ember-1 (low) vs GPT-5.2 Chat

average score लगभग बराबर है: 7.0 vs 7.0. GPT-5.2 Chat की benchmark लागत कम है: $0.594 vs $1.488. GPT-5.2 Chat तेज है: 7.43s vs 34.90s, pass rates 65.2% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#157
कुल आउटपुट टोकन
56,766
प्रतिक्रिया समय (औसत)
34.90s
कुल लागत
$1.488
रैंक
#153
कुल आउटपुट टोकन
29,742
प्रतिक्रिया समय (औसत)
7.43s
कुल लागत
$0.594
अनुशंसित मॉडल GPT-5.2 Chat

It has the best score here (7.0), while costing about 2.5x less than Ember-1 (low).

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 low रिलीज़: 2026-09-28 GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11
स्कोर 7.0 7.0
रैंक #157 #153
विश्वसनीयता 8.8 10.0
संगति 8.2 8.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 65.2% 66.7%
अस्थिर टेस्ट 5 4
कुल रन 69 69
प्रति परिणाम लागत 11.441 4.564
कुल लागत $1.488 $0.594
इनपुट कीमत $3.000 / 1M $1.750 / 1M
आउटपुट कीमत $15.000 / 1M $14.000 / 1M
कुल इनपुट टोकन 211,908 101,104
आउटपुट टोकन 14,158 29,742
रीजनिंग टोकन 42,608 0
प्रतिक्रिया समय (औसत) 34.90s 7.43s
प्रतिक्रिया समय (अधिकतम) 121.29s 38.52s
प्रतिक्रिया समय (कुल) 802.79s 163.35s
पैरामीटर ~2.8T कुल (~104B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#157 Ember-1

low
लागत
$0.016
समय
24.2s
टोकन
1,165 tok

#153 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 10.0 10.0 100.0% 0 37.91s 8,097 2,518 13,142
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

त्वरित तुलना

तुलना जोड़ी बदलें