नेव्हिगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Kimi K2.5 (medium) vs GLM 5.1

GLM 5.1 average score मध्ये पुढे आहे: 6.5 vs 6.4. GLM 5.1 चा benchmark खर्च कमी आहे: $0.451 vs $0.841. GLM 5.1 वेगवान आहे: 11.10s vs 125.76s, pass rates 60.9% vs 47.8%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-10-05

तुलना केलेली मॉडेल्स

क्रमांक
#211
एकूण आउटपुट टोकन्स
241,096
प्रतिसाद वेळ (सरासरी)
125.76s
एकूण खर्च
$0.841
क्रमांक
#203
एकूण आउटपुट टोकन्स
20,076
प्रतिसाद वेळ (सरासरी)
11.10s
एकूण खर्च
$0.451
शिफारस केलेले मॉडेल GLM 5.1

It has the best score here (6.5), while costing about 1.9x less than Kimi K2.5 (medium).

तपशीलवार तुलना

मेट्रिक Kimi K2.5 Kimi K2.5 medium प्रकाशन: 2026-01-27 GLM 5.1 GLM 5.1 none प्रकाशन: 2026-04-07
स्कोअर 6.4 6.5
क्रमांक #211 #203
विश्वसनीयता 9.6 10.0
सुसंगतता 7.1 8.2
प्रयत्न 69/69 69/69
बरोबर चाचण्या
प्रति प्रयत्न पास दर 60.9% 47.8%
अस्थिर चाचण्या 8 5
एकूण रन 69 69
प्रति निकाल खर्च 6.085 3.478
एकूण खर्च $0.841 $0.451
इनपुट किंमत $0.450 / 1M $1.400 / 1M
आउटपुट किंमत $2.250 / 1M $4.400 / 1M
कॅश वाचण्याची किंमत $0.070 / 1M $0.260 / 1M
कॅश लिहिण्याची किंमत लागू नाही लागू नाही
एकूण इनपुट टोकन्स 292,271 258,956
आउटपुट टोकन्स 55,025 20,076
रिझनिंग टोकन्स 186,071 0
प्रतिसाद वेळ (सरासरी) 125.76s 11.10s
प्रतिसाद वेळ (कमाल) 566.79s 107.19s
प्रतिसाद वेळ (एकूण) 2137.84s 255.39s
पॅरामीटर्स 1T एकूण (32B सक्रिय) 744B एकूण (40B सक्रिय)
उपलब्धता वेट्स उपलब्ध मुक्त स्रोत

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#211 MoonshotAI: Kimi K2.5

medium
खर्च
$0.030
वेळ
58.6s
टोकन्स
8,683 tok

#203 GLM 5.1

none
Reached the allocated time limit (300 seconds) without receiving showcase output.
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GLM 5.1 3.9 9.7 0.0% 0 4.96s 7,256 525 0

झटपट तुलना

तुलना जोडी बदला