नेविगेशन
Advertise here

Ember-1 (low) vs Grok 4.7 (xhigh)

Grok 4.7 (xhigh) average score में आगे है: 7.5 vs 7.5. Ember-1 (low) की benchmark लागत कम है: $0.662 vs $2.625. Ember-1 (low) तेज है: 30.98s vs 115.74s, pass rates 66.7% vs 77.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#120
कुल आउटपुट टोकन
37,467
प्रतिक्रिया समय (औसत)
30.98s
कुल लागत
$0.662
रैंक
#116
कुल आउटपुट टोकन
505,069
प्रतिक्रिया समय (औसत)
115.74s
कुल लागत
$2.625
अनुशंसित मॉडल Ember-1 (low)

Its score stays close to the best score here (7.5 vs 7.5), while costing about 4.0x less than Grok 4.7 (xhigh).

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 low रिलीज़: 2026-09-28 Grok 4.7 Grok 4.7 xhigh रिलीज़: 2026-09-21
स्कोर 7.5 7.5
रैंक #120 #116
विश्वसनीयता 8.1 9.6
संगति 8.5 7.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 66.7% 77.3%
अस्थिर टेस्ट 4 6
कुल रन 66 66
प्रति परिणाम लागत 5.085 18.745
कुल लागत $0.662 $2.625
इनपुट कीमत $3.000 / 1M $1.600 / 1M
आउटपुट कीमत $15.000 / 1M $4.800 / 1M
कुल इनपुट टोकन 33,011 124,896
आउटपुट टोकन 4,780 4,890
रीजनिंग टोकन 32,687 500,179
प्रतिक्रिया समय (औसत) 30.98s 115.74s
प्रतिक्रिया समय (अधिकतम) 93.10s 775.64s
प्रतिक्रिया समय (कुल) 681.50s 2546.31s
पैरामीटर ~2.8T कुल (~104B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#120 Ember-1

low
लागत
$0.016
समय
24.2s
टोकन
1,165 tok

#116 SpaceXAI: Grok 4.7

xhigh
लागत
$0.235
समय
544.2s
टोकन
39,247 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 10.0 10.0 100.0% 0 37.91s 8,097 2,518 13,142
Grok 4.7 5.3 4.5 55.6% 2 414.53s 10,168 327 256,935

त्वरित तुलना

तुलना जोड़ी बदलें