नेविगेशन
Advertise here

Ember-1 (high) vs Kimi K2.6 (medium)

average score लगभग बराबर है: 6.9 vs 6.8. Kimi K2.6 (medium) की benchmark लागत कम है: $1.323 vs $2.405. Ember-1 (high) तेज है: 58.14s vs 121.25s, pass rates 71.0% vs 60.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#163
कुल आउटपुट टोकन
121,223
प्रतिक्रिया समय (औसत)
58.14s
कुल लागत
$2.405
रैंक
#168
कुल आउटपुट टोकन
396,671
प्रतिक्रिया समय (औसत)
121.25s
कुल लागत
$1.323
अनुशंसित मॉडल Kimi K2.6 (medium)

It has the best score here (6.8), while costing about 1.8x less than Ember-1 (high).

विस्तृत तुलना

मेट्रिक Ember-1 Ember-1 high रिलीज़: 2026-09-28 Kimi K2.6 Kimi K2.6 medium रिलीज़: 2026-04-20
स्कोर 6.9 6.8
रैंक #163 #168
विश्वसनीयता 8.6 10.0
संगति 7.2 8.4
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 71.0% 60.9%
अस्थिर टेस्ट 8 4
कुल रन 69 69
प्रति परिणाम लागत 20.041 12.282
कुल लागत $2.405 $1.323
इनपुट कीमत $3.000 / 1M $0.650 / 1M
आउटपुट कीमत $15.000 / 1M $3.410 / 1M
कुल इनपुट टोकन 195,489 226,880
आउटपुट टोकन 12,475 65,346
रीजनिंग टोकन 108,748 331,325
प्रतिक्रिया समय (औसत) 58.14s 121.25s
प्रतिक्रिया समय (अधिकतम) 255.06s 876.20s
प्रतिक्रिया समय (कुल) 1337.19s 2667.55s
पैरामीटर ~2.8T कुल (~104B सक्रिय) 1T कुल (32B सक्रिय)
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#163 Ember-1

high
लागत
$0.038
समय
55.1s
टोकन
2,671 tok

#168 MoonshotAI: Kimi K2.6

medium
लागत
$0.013
समय
103.4s
टोकन
3,620 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Ember-1 8.2 7.2 88.9% 1 72.23s 7,144 1,281 23,093
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189

त्वरित तुलना

तुलना जोड़ी बदलें