नेविगेशन
Advertise here

Kimi K2.6 (medium) vs Inkling (low)

average score लगभग बराबर है: 6.8 vs 6.8. Inkling (low) की benchmark लागत कम है: $0.304 vs $1.323. Inkling (low) तेज है: 6.81s vs 121.25s, pass rates 60.9% vs 56.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#168
कुल आउटपुट टोकन
396,671
प्रतिक्रिया समय (औसत)
121.25s
कुल लागत
$1.323
रैंक
#170
कुल आउटपुट टोकन
22,037
प्रतिक्रिया समय (औसत)
6.81s
कुल लागत
$0.304
अनुशंसित मॉडल Inkling (low)

It has the best score here (6.8), while costing about 4.4x less than Kimi K2.6 (medium).

विस्तृत तुलना

मेट्रिक Kimi K2.6 Kimi K2.6 medium रिलीज़: 2026-04-20 Inkling Inkling low रिलीज़: 2026-07-18 निःशुल्क उपलब्ध
स्कोर 6.8 6.8
रैंक #168 #170
विश्वसनीयता 10.0 10.0
संगति 8.4 8.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 60.9% 56.5%
अस्थिर टेस्ट 4 4
कुल रन 69 69
प्रति परिणाम लागत 12.282 2.756
कुल लागत $1.323 $0.304
इनपुट कीमत $0.650 / 1M $1.000 / 1M
आउटपुट कीमत $3.410 / 1M $4.050 / 1M
कुल इनपुट टोकन 226,880 213,901
आउटपुट टोकन 65,346 9,623
रीजनिंग टोकन 331,325 12,414
प्रतिक्रिया समय (औसत) 121.25s 6.81s
प्रतिक्रिया समय (अधिकतम) 876.20s 44.24s
प्रतिक्रिया समय (कुल) 2667.55s 156.70s
पैरामीटर 1T कुल (32B सक्रिय) 975B कुल (41B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#168 MoonshotAI: Kimi K2.6

medium
लागत
$0.013
समय
103.4s
टोकन
3,620 tok

#170 Thinking Machines: Inkling

low
लागत
$0.002
समय
6.1s
टोकन
502 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 5.7 8.6 33.3% 0 214.42s 2,925 9,970 77,189
Inkling 5.1 7.2 22.2% 1 8.71s 7,374 355 4,961

त्वरित तुलना

तुलना जोड़ी बदलें