नेविगेशन
AI BENCHY
Advertise here

KAT-Coder-Pro V2.5 (medium) vs Kimi K2.5 (medium)

average score लगभग बराबर है: 6.9 vs 7.0. KAT-Coder-Pro V2.5 (medium) की benchmark लागत कम है: $0.478 vs $0.639. KAT-Coder-Pro V2.5 (medium) तेज है: 24.87s vs 98.19s, pass rates 65.2% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-26

रैंक
#126
कुल आउटपुट टोकन
139,375
प्रतिक्रिया समय (औसत)
24.87s
कुल लागत
$0.478
रैंक
#125
कुल आउटपुट टोकन
220,942
प्रतिक्रिया समय (औसत)
98.19s
कुल लागत
$0.639
अनुशंसित मॉडल KAT-Coder-Pro V2.5 (medium)

It has the best score here (6.9), while responding about 3.9x faster than Kimi K2.5 (medium).

विस्तृत तुलना

मेट्रिक KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 medium रिलीज़: 2026-07-14 Kimi K2.5 Kimi K2.5 medium रिलीज़: 2026-01-27
स्कोर 6.9 7.0
रैंक #126 #125
विश्वसनीयता 10.0 10.0
संगति 7.0 7.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 65.2% 63.6%
अस्थिर टेस्ट 8 8
कुल रन 66 66
प्रति परिणाम लागत 4.342 4.849
कुल लागत $0.478 $0.639
इनपुट कीमत $0.740 / 1M $0.600 / 1M
आउटपुट कीमत $2.960 / 1M $3.000 / 1M
कुल इनपुट टोकन 87,916 118,496
आउटपुट टोकन 7,213 53,522
रीजनिंग टोकन 132,162 167,420
प्रतिक्रिया समय (औसत) 24.87s 98.19s
प्रतिक्रिया समय (अधिकतम) 257.00s 281.00s
प्रतिक्रिया समय (कुल) 547.14s 1571.05s
पैरामीटर ~700B कुल (~72B सक्रिय) 1T कुल (32B सक्रिय)
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#126 KAT-Coder-Pro V2.5

medium
लागत
$0.009
समय
25.6s
टोकन
2,939 tok

#125 MoonshotAI: Kimi K2.5

medium
लागत
$0.030
समय
58.6s
टोकन
8,683 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 33.10s 7,893 416 33,658
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693

त्वरित तुलना

तुलना जोड़ी बदलें