नेविगेशन
Advertise here

Claude Opus 5 vs Ember-1 (low)

Claude Opus 5 average score में आगे है: 7.5 vs 7.5. Ember-1 (low) की benchmark लागत कम है: $0.662 vs $1.550. Claude Opus 5 तेज है: 7.65s vs 30.98s, pass rates 57.6% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-28

तुलना किए गए मॉडल

रैंक
#115
कुल आउटपुट टोकन
24,866
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$1.550
रैंक
#120
कुल आउटपुट टोकन
37,467
प्रतिक्रिया समय (औसत)
30.98s
कुल लागत
$0.662
अनुशंसित मॉडल Claude Opus 5

It has the best score here (7.5), while responding about 4.0x faster than Ember-1 (low).

विस्तृत तुलना

मेट्रिक Claude Opus 5 Claude Opus 5 none रिलीज़: 2026-07-25 Ember-1 Ember-1 low रिलीज़: 2026-09-28
स्कोर 7.5 7.5
रैंक #115 #120
विश्वसनीयता 10.0 8.1
संगति 9.6 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 57.6% 66.7%
अस्थिर टेस्ट 1 4
कुल रन 66 66
प्रति परिणाम लागत 12.912 5.085
कुल लागत $1.550 $0.662
इनपुट कीमत $5.000 / 1M $3.000 / 1M
आउटपुट कीमत $25.000 / 1M $15.000 / 1M
कुल इनपुट टोकन 185,547 33,011
आउटपुट टोकन 24,866 4,780
रीजनिंग टोकन 0 32,687
प्रतिक्रिया समय (औसत) 7.65s 30.98s
प्रतिक्रिया समय (अधिकतम) 47.72s 93.10s
प्रतिक्रिया समय (कुल) 168.35s 681.50s
पैरामीटर ~5T कुल (~500B सक्रिय) ~2.8T कुल (~104B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#115 Claude Opus 5

none
लागत
$0.271
समय
149.3s
टोकन
10,962 tok

#120 Ember-1

low
लागत
$0.016
समय
24.2s
टोकन
1,165 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Opus 5 5.9 9.7 33.3% 0 5.54s 10,590 2,886 0
Ember-1 10.0 10.0 100.0% 0 37.91s 8,097 2,518 13,142

त्वरित तुलना

तुलना जोड़ी बदलें