नेविगेशन
Advertise here

Ember-1 (max) vs Grok 4.7 (xhigh)

average score लगभग बराबर है: 6.7 vs 6.7. Ember-1 (max) की benchmark लागत कम है: $3.264 vs $4.054. Ember-1 (max) तेज है: 97.34s vs 123.96s, pass rates 59.4% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#181
कुल आउटपुट टोकन
186,901
प्रतिक्रिया समय (औसत)
97.34s
कुल लागत
$3.264
रैंक
#175
कुल आउटपुट टोकन
572,315
प्रतिक्रिया समय (औसत)
123.96s
कुल लागत
$4.054
अनुशंसित मॉडल Ember-1 (max)

It has the strongest score in this comparison (6.7) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 max रिलीज़: 2026-09-28 Grok 4.7 Grok 4.7 xhigh रिलीज़: 2026-09-21
स्कोर 6.7 6.7
रैंक #181 #175
विश्वसनीयता 8.3 9.7
संगति 7.8 7.8
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 59.4% 73.9%
अस्थिर टेस्ट 6 6
कुल रन 69 69
प्रति परिणाम लागत 29.671 24.272
कुल लागत $3.264 $4.054
इनपुट कीमत $3.000 / 1M $2.000 / 1M
आउटपुट कीमत $15.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 153,399 310,049
आउटपुट टोकन 7,803 6,094
रीजनिंग टोकन 179,098 566,221
प्रतिक्रिया समय (औसत) 97.34s 123.96s
प्रतिक्रिया समय (अधिकतम) 587.08s 775.64s
प्रतिक्रिया समय (कुल) 2238.73s 2851.07s
पैरामीटर ~2.8T कुल (~104B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#181 Ember-1

max
लागत
$0.163
समय
229.4s
टोकन
11,002 tok

#175 SpaceXAI: Grok 4.7

xhigh
लागत
$0.235
समय
544.2s
टोकन
39,247 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 5.2 4.4 55.6% 2 105.09s 3,362 1,149 27,957
Grok 4.7 5.3 4.5 55.6% 2 414.53s 10,168 327 256,935

त्वरित तुलना

तुलना जोड़ी बदलें