AI BENCHY
Advertise here
#146

GLM 4.7 Flash

Z.ai प्रकाशन: 2026-01-19 चाचणी तारीख: 2026-06-04 13:05 z-ai/glm-4.7-flash::none
(medium) (none)

सारांश

GLM 4.7 Flash AI BENCHY वर 4.9 स्कोर करते आणि #146 वर आहे. याची reliability 10.0, pass rate 36.5%, एकूण खर्च $0.004, आणि सरासरी response time 2.86s आहे.

GLM 4.7 Flash खास का आहे: हे डोमेन-विशिष्ट मध्ये सर्वाधिक उठून दिसते, जिथे त्याचा rank #1 आहे; तर टूल कॉलिंग हा सर्वात कमकुवत भाग आहे, rank #14.

सुसंगतता

8.8

एकूण आउटपुट टोकन्स

2,521

एकूण इनपुट टोकन्स

38,745

इनपुट किंमत

$0.060 / 1M

आउटपुट किंमत

$0.400 / 1M

बरोबर चाचण्या

चुकीच्या चाचण्या: 15

प्रति प्रयत्न पास दर: 36.5%

अस्थिर चाचण्या

3

अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).

प्रतिसाद वेळ (सरासरी)

2.86s

प्रतिसाद वेळ (कमाल): 7.05s

प्रतिसाद वेळ (एकूण): 40.04s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#146 GLM 4.7 Flash

none
अवैध SVG
खर्च
$0.000
वेळ
300.0s
टोकन्स
0 tok

रन इतिहास

चाचणी तारीख स्कोअर विश्वसनीयता बरोबर चाचण्या एकूण खर्च तुलना करा
2026-06-04 13:05 नवीन चाचणी जोडली 5.5 10.0 $0.004 सध्याची रन
2026-05-21 23:41 सूट बदलला 5.6 10.0 $0.004 तुलना करा
2026-04-11 01:19 पहिली नोंदलेली रन 5.6 लागू नाही $0.003 तुलना करा

या रनमध्ये वेगळा बेंचमार्क सूट वापरला गेला. ऐतिहासिक बदल वाचताना सूटमधील बदल लक्षात घ्या.

किंमत इतिहास

OpenRouter मधील या मॉडेलचा ऐतिहासिक किंमत डेटा.

तारीख इनपुट किंमत आउटपुट किंमत
2026-06-04 15:40 $0.060 / 1M $0.400 / 1M

चार्ट्स

पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

झटपट तुलना

श्रेणीवार तपशील

श्रेणी स्कोअर सुसंगतता बरोबर चाचण्या
अँटी-एआय युक्त्या 5.2 7.9
कोडिंग 4.3 10.0
संयुक्त 3.0 10.0
डेटा पार्सिंग आणि निष्कर्षण 7.3 5.8
डोमेन-विशिष्ट 7.7 10.0
Samanya Buddhimatta 4.0 10.0
सूचनांचे पालन 6.5 10.0
कोडी सोडवणे 6.4 10.0
टूल कॉलिंग 2.8 1.6
सामान्य ज्ञान 3.0 10.0

तुलना केलेली मॉडेल्स