नेविगेशन
AI BENCHY
Advertise here

Kimi K2.5 (medium) vs GLM 5.1 (medium)

average score लगभग बराबर है: 7.0 vs 7.0. Kimi K2.5 (medium) की benchmark लागत कम है: $0.607 vs $0.727. GLM 5.1 (medium) तेज है: 58.80s vs 98.19s, pass rates 63.6% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-15

रैंक
#122
कुल आउटपुट टोकन
220,942
प्रतिक्रिया समय (औसत)
98.19s
कुल लागत
$0.607
रैंक
#117
कुल आउटपुट टोकन
215,889
प्रतिक्रिया समय (औसत)
58.80s
कुल लागत
$0.727
अनुशंसित मॉडल Kimi K2.5 (medium)

It has the strongest score in this comparison (7.0) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Kimi K2.5 Kimi K2.5 medium रिलीज़: 2026-01-27 GLM 5.1 GLM 5.1 medium रिलीज़: 2026-04-07
स्कोर 7.0 7.0
रैंक #122 #117
विश्वसनीयता 10.0 8.1
संगति 7.0 8.4
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 65.2%
अस्थिर टेस्ट 8 4
कुल रन 66 66
प्रति परिणाम लागत 4.849 6.923
कुल लागत $0.607 $0.727
इनपुट कीमत $0.571 / 1M $0.966 / 1M
आउटपुट कीमत $2.850 / 1M $3.036 / 1M
कुल इनपुट टोकन 118,496 82,592
आउटपुट टोकन 53,522 16,089
रीजनिंग टोकन 167,420 199,800
प्रतिक्रिया समय (औसत) 98.19s 58.80s
प्रतिक्रिया समय (अधिकतम) 281.00s 308.75s
प्रतिक्रिया समय (कुल) 1571.05s 1234.72s
पैरामीटर 1T कुल (32B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#122 MoonshotAI: Kimi K2.5

medium
लागत
$0.030
समय
58.6s
टोकन
8,683 tok

#117 GLM 5.1

medium
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

त्वरित तुलना

तुलना जोड़ी बदलें