नेविगेशन
AI BENCHY
Advertise here

KAT-Coder-Air V2.5 (medium) vs Kimi K2.6

Kimi K2.6 average score में आगे है: 5.7 vs 5.6. KAT-Coder-Air V2.5 (medium) की benchmark लागत कम है: $0.048 vs $0.233. KAT-Coder-Air V2.5 (medium) तेज है: 8.65s vs 19.57s, pass rates 45.5% vs 30.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#226
कुल आउटपुट टोकन
66,576
प्रतिक्रिया समय (औसत)
8.65s
कुल लागत
$0.048
रैंक
#217
कुल आउटपुट टोकन
30,249
प्रतिक्रिया समय (औसत)
19.57s
कुल लागत
$0.233
अनुशंसित मॉडल KAT-Coder-Air V2.5 (medium)

Its score stays close to the best score here (5.6 vs 5.7), while costing about 4.9x less than Kimi K2.6.

विस्तृत तुलना

मेट्रिक KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 medium रिलीज़: 2026-07-14 Kimi K2.6 Kimi K2.6 none रिलीज़: 2026-04-20
स्कोर 5.6 5.7
रैंक #226 #217
विश्वसनीयता 9.6 10.0
संगति 8.9 9.3
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 45.5% 30.3%
अस्थिर टेस्ट 3 2
कुल रन 66 66
प्रति परिणाम लागत 0.596 3.732
कुल लागत $0.048 $0.233
इनपुट कीमत $0.150 / 1M $0.950 / 1M
आउटपुट कीमत $0.600 / 1M $4.000 / 1M
कुल इनपुट टोकन 51,369 116,983
आउटपुट टोकन 8,008 30,249
रीजनिंग टोकन 58,568 0
प्रतिक्रिया समय (औसत) 8.65s 19.57s
प्रतिक्रिया समय (अधिकतम) 48.19s 238.89s
प्रतिक्रिया समय (कुल) 190.35s 430.58s
पैरामीटर ~35B कुल (~3B सक्रिय) 1T कुल (32B सक्रिय)
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#226 KAT-Coder-Air V2.5

medium
लागत
$0.003
समय
23.7s
टोकन
4,924 tok

#217 MoonshotAI: Kimi K2.6

none
लागत
$0.020
समय
127.4s
टोकन
4,429 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Air V2.5 3.6 7.0 22.2% 1 23.37s 7,893 5,199 29,973
Kimi K2.6 5.5 9.8 33.3% 0 82.57s 5,986 14,754 0

त्वरित तुलना

तुलना जोड़ी बदलें