AI BENCHY
Advertise here
#15

GLM 5

Z.ai प्रकाशन: 2026-02-12 चाचणी तारीख: 2026-06-04 13:07 z-ai/glm-5::medium
(medium) (none)

सारांश

GLM 5 AI BENCHY वर 8.6 स्कोर करते आणि #15 वर आहे. याची reliability 10.0, pass rate 82.5%, एकूण खर्च $0.228, आणि सरासरी response time 33.54s आहे.

सुसंगतता

8.5

एकूण खर्च (सध्याची किंमत)

$0.228 ↓ -9.2%

या किमतीवर चाचणी केली: $0.251

एकूण आउटपुट टोकन्स

124,566

एकूण इनपुट टोकन्स

35,224

इनपुट किंमत

$0.600 / 1M

आउटपुट किंमत

$1.920 / 1M

बरोबर चाचण्या

चुकीच्या चाचण्या: 6

प्रति प्रयत्न पास दर: 82.5%

अस्थिर चाचण्या

4

अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).

प्रतिसाद वेळ (सरासरी)

33.54s

प्रतिसाद वेळ (कमाल): 99.85s

प्रतिसाद वेळ (एकूण): 435.99s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#15 GLM 5

medium
खर्च
$0.005
वेळ
20.7s
टोकन्स
2,068 tok

रन इतिहास

चाचणी तारीख स्कोअर विश्वसनीयता बरोबर चाचण्या एकूण खर्च तुलना करा
2026-06-04 13:07 नवीन चाचणी जोडली 8.3 10.0 $0.228 सध्याची रन
2026-05-21 23:44 पुन्हा चाचणी 8.2 10.0 $0.237 तुलना करा
2026-04-22 12:55 पहिली नोंदलेली रन 8.4 लागू नाही $0.155 तुलना करा

या रनमध्ये वेगळा बेंचमार्क सूट वापरला गेला. ऐतिहासिक बदल वाचताना सूटमधील बदल लक्षात घ्या.

रन तुलना

रनस्कोअरसुसंगतताविश्वसनीयताबरोबर चाचण्याअस्थिर चाचण्याएकूण आउटपुट टोकन्सएकूण इनपुट टोकन्सएकूण खर्चप्रतिसाद वेळ (सरासरी)
2026-06-04 13:07 · सध्याची रन8.68.510.015/214124,56635,224$0.22833.54s
2026-05-21 23:44 · पुन्हा चाचणी8.28.410.014/204119,8980$0.23733.39s
फरक+0.4+0.10.0+10+4668+35224-$0.010+152ms

या दोन रनमध्ये वेगवेगळे बेंचमार्क सूट वापरले गेले, त्यामुळे फरकांमध्ये मॉडेलमधील आणि सूटमधील दोन्ही बदल दिसतात.

किंमत इतिहास

OpenRouter मधील या मॉडेलचा ऐतिहासिक किंमत डेटा.

तारीख इनपुट किंमत आउटपुट किंमत
2026-06-04 15:40 $0.600 / 1M $1.920 / 1M

चार्ट्स

पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

झटपट तुलना

श्रेणीवार तपशील

श्रेणी स्कोअर सुसंगतता बरोबर चाचण्या
अँटी-एआय युक्त्या 10.0 10.0
कोडिंग 10.0 10.0
संयुक्त 10.0 10.0
डेटा पार्सिंग आणि निष्कर्षण 7.1 5.6
डोमेन-विशिष्ट 3.5 4.4
Samanya Buddhimatta 6.1 3.1
सूचनांचे पालन 10.0 10.0
कोडी सोडवणे 10.0 10.0
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना केलेली मॉडेल्स