नेव्हिगेशन
Advertise here

Ember-1 (high) vs Kimi K2.6 (medium)

average score जवळपास समान आहे: 6.9 vs 6.8. Kimi K2.6 (medium) चा benchmark खर्च कमी आहे: $1.323 vs $2.405. Ember-1 (high) वेगवान आहे: 58.14s vs 121.25s, pass rates 71.0% vs 60.9%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-01

तुलना केलेली मॉडेल्स

क्रमांक
#163
एकूण आउटपुट टोकन्स
121,223
प्रतिसाद वेळ (सरासरी)
58.14s
एकूण खर्च
$2.405
क्रमांक
#168
एकूण आउटपुट टोकन्स
396,671
प्रतिसाद वेळ (सरासरी)
121.25s
एकूण खर्च
$1.323
शिफारस केलेले मॉडेल Kimi K2.6 (medium)

It has the best score here (6.8), while costing about 1.8x less than Ember-1 (high).

तपशीलवार तुलना

मेट्रिक Ember-1 Ember-1 high प्रकाशन: 2026-09-28 Kimi K2.6 Kimi K2.6 medium प्रकाशन: 2026-04-20
स्कोअर 6.9 6.8
क्रमांक #163 #168
विश्वसनीयता 8.6 10.0
सुसंगतता 7.2 8.4
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.0% 60.9%
अस्थिर चाचण्या 8 4
एकूण रन 69 69
प्रति निकाल खर्च 20.041 12.282
एकूण खर्च $2.405 $1.323
इनपुट किंमत $3.000 / 1M $0.650 / 1M
आउटपुट किंमत $15.000 / 1M $3.410 / 1M
एकूण इनपुट टोकन्स 195,489 226,880
आउटपुट टोकन्स 12,475 65,346
रिझनिंग टोकन्स 108,748 331,325
प्रतिसाद वेळ (सरासरी) 58.14s 121.25s
प्रतिसाद वेळ (कमाल) 255.06s 876.20s
प्रतिसाद वेळ (एकूण) 1337.19s 2667.55s
पॅरामीटर्स ~2.8T एकूण (~104B सक्रिय) 1T एकूण (32B सक्रिय)
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#163 Ember-1

high
खर्च
$0.038
वेळ
55.1s
टोकन्स
2,671 tok

#168 MoonshotAI: Kimi K2.6

medium
खर्च
$0.013
वेळ
103.4s
टोकन्स
3,620 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Ember-1 8.2 7.2 88.9% 1 72.23s 7,144 1,281 23,093
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189

झटपट तुलना

तुलना जोडी बदला