नेविगेशन
Advertise here

Claude Sonnet 5.5 (low) vs Ember-1 (high)

average score लगभग बराबर है: 6.9 vs 6.9. Claude Sonnet 5.5 (low) की benchmark लागत कम है: $0.909 vs $2.405. Claude Sonnet 5.5 (low) तेज है: 7.46s vs 58.14s, pass rates 46.4% vs 71.0%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#166
कुल आउटपुट टोकन
32,443
प्रतिक्रिया समय (औसत)
7.46s
कुल लागत
$0.909
रैंक
#163
कुल आउटपुट टोकन
121,223
प्रतिक्रिया समय (औसत)
58.14s
कुल लागत
$2.405
अनुशंसित मॉडल Claude Sonnet 5.5 (low)

It has the best score here (6.9), while costing about 2.6x less than Ember-1 (high).

विस्तृत तुलना

मेट्रिक Claude Sonnet 5.5 Claude Sonnet 5.5 low रिलीज़: 2026-09-29 Ember-1 Ember-1 high रिलीज़: 2026-09-28
स्कोर 6.9 6.9
रैंक #166 #163
विश्वसनीयता 10.0 8.6
संगति 9.4 7.2
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 46.4% 71.0%
अस्थिर टेस्ट 2 8
कुल रन 69 69
प्रति परिणाम लागत 9.082 20.041
कुल लागत $0.909 $2.405
इनपुट कीमत $2.000 / 1M $3.000 / 1M
आउटपुट कीमत $10.000 / 1M $15.000 / 1M
कुल इनपुट टोकन 291,853 195,489
आउटपुट टोकन 24,116 12,475
रीजनिंग टोकन 8,327 108,748
प्रतिक्रिया समय (औसत) 7.46s 58.14s
प्रतिक्रिया समय (अधिकतम) 46.61s 255.06s
प्रतिक्रिया समय (कुल) 171.47s 1337.19s
पैरामीटर ~1T कुल (~100B सक्रिय) ~2.8T कुल (~104B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 Claude Sonnet 5.5

low
लागत
$0.020
समय
15.3s
टोकन
2,077 tok

#163 Ember-1

high
लागत
$0.038
समय
55.1s
टोकन
2,671 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5.5 3.2 9.7 0.0% 0 5.81s 10,608 5,903 0
Ember-1 8.2 7.2 88.9% 1 72.23s 7,144 1,281 23,093

त्वरित तुलना

तुलना जोड़ी बदलें