नेविगेशन
Advertise here

Ember-1 (max) vs Grok 4.7 (high)

average score लगभग बराबर है: 6.7 vs 6.7. Ember-1 (max) की benchmark लागत कम है: $3.264 vs $3.582. Ember-1 (max) तेज है: 97.34s vs 122.19s, pass rates 59.4% vs 72.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#181
कुल आउटपुट टोकन
186,901
प्रतिक्रिया समय (औसत)
97.34s
कुल लागत
$3.264
रैंक
#179
कुल आउटपुट टोकन
487,184
प्रतिक्रिया समय (औसत)
122.19s
कुल लागत
$3.582
अनुशंसित मॉडल Ember-1 (max)

It has the strongest score in this comparison (6.7) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 max रिलीज़: 2026-09-28 Grok 4.7 Grok 4.7 high रिलीज़: 2026-09-21
स्कोर 6.7 6.7
रैंक #181 #179
विश्वसनीयता 8.3 9.6
संगति 7.8 7.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 59.4% 72.5%
अस्थिर टेस्ट 6 7
कुल रन 69 69
प्रति परिणाम लागत 29.671 23.360
कुल लागत $3.264 $3.582
इनपुट कीमत $3.000 / 1M $2.000 / 1M
आउटपुट कीमत $15.000 / 1M $6.000 / 1M
कुल इनपुट टोकन 153,399 329,276
आउटपुट टोकन 7,803 8,172
रीजनिंग टोकन 179,098 479,012
प्रतिक्रिया समय (औसत) 97.34s 122.19s
प्रतिक्रिया समय (अधिकतम) 587.08s 573.57s
प्रतिक्रिया समय (कुल) 2238.73s 2810.40s
पैरामीटर ~2.8T कुल (~104B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#181 Ember-1

max
लागत
$0.163
समय
229.4s
टोकन
11,002 tok

#179 SpaceXAI: Grok 4.7

high
लागत
$0.110
समय
301.3s
टोकन
23,143 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 5.2 4.4 55.6% 2 105.09s 3,362 1,149 27,957
Grok 4.7 6.0 4.6 66.7% 2 335.92s 10,266 353 199,976

त्वरित तुलना

तुलना जोड़ी बदलें