नेविगेशन
AI BENCHY
Advertise here

GLM 5.2 (medium) vs GLM 5 (medium)

GLM 5.2 (medium) average score में आगे है: 7.8 vs 7.7. GLM 5.2 (medium) की benchmark लागत कम है: $0.176 vs $0.307. GLM 5.2 (medium) तेज है: 23.28s vs 33.54s, pass rates 80.3% vs 78.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-01

रैंक
#49
कुल आउटपुट टोकन
61,761
प्रतिक्रिया समय (औसत)
23.28s
कुल लागत
$0.176
रैंक
#54
कुल आउटपुट टोकन
124,566
प्रतिक्रिया समय (औसत)
33.54s
कुल लागत
$0.307
अनुशंसित मॉडल GLM 5.2 (medium)

It has the best score here (7.8), while costing about 1.7x less than GLM 5 (medium).

विस्तृत तुलना

मेट्रिक GLM 5.2 GLM 5.2 medium रिलीज़: 2026-06-17 GLM 5 GLM 5 medium रिलीज़: 2026-02-12
स्कोर 7.8 7.7
रैंक #49 #54
विश्वसनीयता 9.5 10.0
संगति 8.0 8.1
सही परीक्षण
प्रति प्रयास पास दर 80.3% 78.8%
अस्थिर टेस्ट 4 4
कुल रन 63 63
प्रति परिणाम लागत 2.159 1.668
कुल लागत $0.176 $0.307
इनपुट कीमत $0.761 / 1M $0.950 / 1M
आउटपुट कीमत $2.389 / 1M $2.551 / 1M
कुल इनपुट टोकन 37,199 35,224
आउटपुट टोकन 12,261 21,570
रीजनिंग टोकन 49,500 102,996
प्रतिक्रिया समय (औसत) 23.28s 33.54s
प्रतिक्रिया समय (अधिकतम) 101.36s 99.85s
प्रतिक्रिया समय (कुल) 488.94s 435.99s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#49 GLM 5.2

medium
लागत
$0.041
समय
195.8s
टोकन
9,287 tok

#54 GLM 5

medium
लागत
$0.005
समय
20.7s
टोकन
2,068 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

त्वरित तुलना

तुलना जोड़ी बदलें