Advertise here
#123

GLM 5.1

Z.ai प्रकाशन: 2026-04-07 चाचणी तारीख: 2026-10-01 00:07 z-ai/glm-5.1::medium
744B एकूण (40B सक्रिय)MoEमुक्त स्रोत
(medium) (none)

सारांश

GLM 5.1 AI BENCHY वर 7.5 स्कोर करते आणि #123 वर आहे. याची reliability 9.2, pass rate 66.7%, एकूण खर्च $1.546, आणि सरासरी response time 66.38s आहे.

GLM 5.1 खास का आहे: हे Samanya Buddhimatta मध्ये सर्वाधिक उठून दिसते, जिथे त्याचा rank #1 आहे; तर कोडिंग हा सर्वात कमकुवत भाग आहे, rank #17.

मॉडेलची माहिती

संशोधन दिनांक: 2026-08-12

जाहीर केलेले
पॅरामीटर्स
744B एकूण (40B सक्रिय)
आर्किटेक्चर
MoE
उपलब्धता
मुक्त स्रोत
परवाना
MIT

सुसंगतता

8.4

एकूण खर्च (सध्याची किंमत)

$1.546 ↑ +32.1%

या किमतीवर चाचणी केली: $1.171

एकूण आउटपुट टोकन्स

248,708

एकूण इनपुट टोकन्स

331,577

इनपुट किंमत

$1.400 / 1M

आउटपुट किंमत

$4.400 / 1M

कॅश वाचण्याची किंमत

$0.260 / 1M

कॅश लिहिण्याची किंमत

लागू नाही

कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.

बरोबर चाचण्या

चुकीच्या चाचण्या: 10

प्रति प्रयत्न पास दर: 66.7%

अस्थिर चाचण्या

4

अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).

प्रतिसाद वेळ (सरासरी)

66.38s

प्रतिसाद वेळ (कमाल): 308.75s

प्रतिसाद वेळ (एकूण): 1460.31s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#123 GLM 5.1

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

रन इतिहास

चाचणी तारीख स्कोअर विश्वसनीयता बरोबर चाचण्या एकूण खर्च तुलना करा
2026-10-01 00:07 पुन्हा चाचणी 7.5 9.2 $1.546 ↑ सध्याची रन
2026-07-16 21:29 नवीन चाचणी जोडली 7.1 8.3 $0.535 ↓ तुलना करा
2026-06-04 13:06 नवीन चाचणी जोडली 7.3 6.7 $0.292 ↓ तुलना करा
2026-05-21 23:46 सूट बदलला 7.4 3.3 $0.286 तुलना करा
2026-05-08 14:41 सूट बदलला 7.6 0.0 $0.209 तुलना करा
2026-05-08 14:41 सूट बदलला 7.6 0.0 $0.209 तुलना करा
2026-04-22 12:55 पहिली नोंदलेली रन 7.8 लागू नाही $0.201 तुलना करा

या रनमध्ये वेगळा बेंचमार्क सूट वापरला गेला. ऐतिहासिक बदल वाचताना सूटमधील बदल लक्षात घ्या.

रन तुलना

रनबेंचमार्क कव्हरेजस्कोअरसुसंगतताविश्वसनीयताबरोबर चाचण्याअस्थिर चाचण्याएकूण आउटपुट टोकन्सएकूण इनपुट टोकन्सएकूण खर्चप्रतिसाद वेळ (सरासरी)
2026-10-01 00:07 · सध्याची रन69/69 प्रयत्न7.58.49.213/234248,708331,577$1.54666.38s
2026-06-04 13:06 · नवीन चाचणी जोडली63/63 प्रयत्न7.38.36.712/21487,07632,995$0.29233.67s
फरक—+0.3+0.1+2.5+10+161632+298582+$1.255+32707ms

बेंचमार्क कव्हरेज वेगळे आहे: 69/69 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती) विरुद्ध 63/63 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती). एकूण मूल्ये आणि पुनरावृत्तीवर अवलंबून मेट्रिक्स थेट तुलना करता येत नाहीत.

या दोन रनमध्ये वेगवेगळे बेंचमार्क सूट वापरले गेले, त्यामुळे फरकांमध्ये मॉडेलमधील आणि सूटमधील दोन्ही बदल दिसतात.

किंमत इतिहास

OpenRouter मधील या मॉडेलचा ऐतिहासिक किंमत डेटा.

तारीख इनपुट किंमत आउटपुट किंमत कॅश वाचण्याची किंमत कॅश लिहिण्याची किंमत
2026-06-04 15:40 $0.980 / 1M $3.080 / 1M लागू नाही लागू नाही
2026-06-30 21:25 $0.975 / 1M $4.301 / 1M लागू नाही लागू नाही
2026-07-08 21:00 $0.966 / 1M $3.036 / 1M लागू नाही लागू नाही
2026-08-05 23:12 $0.952 / 1M $2.992 / 1M लागू नाही लागू नाही
2026-08-14 12:51 $1.400 / 1M $4.400 / 1M लागू नाही लागू नाही
2026-10-03 09:03 $1.400 / 1M $4.400 / 1M $0.260 / 1M लागू नाही

चार्ट्स

पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

झटपट तुलना

श्रेणीवार तपशील

श्रेणी स्कोअर सुसंगतता बरोबर चाचण्या
स्वायत्त एजंट कार्ये 10.0 10.0
अँटी-एआय युक्त्या 10.0 10.0
कोडिंग 4.6 3.7
संयुक्त 9.8 10.0
डेटा पार्सिंग आणि निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 3.0 10.0
Samanya Buddhimatta 10.0 10.0
सूचनांचे पालन 6.4 5.8
कोडी सोडवणे 8.2 7.2
टूल कॉलिंग 3.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना केलेली मॉडेल्स