नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kimi K2.6 vs GLM 5.1

average score लगभग बराबर है: 5.7 vs 5.7. GLM 5.1 की benchmark लागत कम है: $0.164 vs $0.230. GLM 5.1 तेज है: 6.74s vs 19.57s, pass rates 30.3% vs 45.5%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#203
कुल आउटपुट टोकन
30,249
प्रतिक्रिया समय (औसत)
19.57s
कुल लागत
$0.230
रैंक
#202
कुल आउटपुट टोकन
14,393
प्रतिक्रिया समय (औसत)
6.74s
कुल लागत
$0.164
अनुशंसित मॉडल GLM 5.1

It has the best score here (5.7), while responding about 2.9x faster than Kimi K2.6.

विस्तृत तुलना

मेट्रिक Kimi K2.6 Kimi K2.6 none रिलीज़: 2026-04-20 GLM 5.1 GLM 5.1 none रिलीज़: 2026-04-07
स्कोर 5.7 5.7
रैंक #203 #202
विश्वसनीयता 10.0 10.0
संगति 9.3 8.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 30.3% 45.5%
अस्थिर टेस्ट 2 5
कुल रन 66 66
प्रति परिणाम लागत 3.732 2.073
कुल लागत $0.230 $0.164
इनपुट कीमत $0.941 / 1M $0.966 / 1M
आउटपुट कीमत $3.961 / 1M $3.036 / 1M
कुल इनपुट टोकन 116,983 124,219
आउटपुट टोकन 30,249 14,393
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 19.57s 6.74s
प्रतिक्रिया समय (अधिकतम) 238.89s 61.20s
प्रतिक्रिया समय (कुल) 430.58s 148.20s
पैरामीटर 1T कुल (32B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता वेट उपलब्ध मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#203 MoonshotAI: Kimi K2.6

none
लागत
$0.020
समय
127.4s
टोकन
4,429 tok

#202 GLM 5.1

none
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Kimi K2.6 5.5 9.8 33.3% 0 82.57s 5,986 14,754 0
GLM 5.1 3.9 9.7 0.0% 0 4.96s 7,256 525 0

त्वरित तुलना

तुलना जोड़ी बदलें