नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GLM 5.2 vs GLM 5.3 (low)

average score लगभग बराबर है: 6.7 vs 6.8. GLM 5.2 की benchmark लागत कम है: $0.153 vs $0.257. GLM 5.2 तेज है: 9.65s vs 13.65s, pass rates 63.6% vs 65.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#138
कुल आउटपुट टोकन
14,344
प्रतिक्रिया समय (औसत)
9.65s
कुल लागत
$0.153
रैंक
#134
कुल आउटपुट टोकन
24,808
प्रतिक्रिया समय (औसत)
13.65s
कुल लागत
$0.257
अनुशंसित मॉडल GLM 5.2

It has the best score here (6.7), while costing about 1.7x less than GLM 5.3 (low).

विस्तृत तुलना

मेट्रिक GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17 GLM 5.3 GLM 5.3 low रिलीज़: 2026-08-20
स्कोर 6.7 6.8
रैंक #138 #134
विश्वसनीयता 10.0 10.0
संगति 9.2 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 63.6% 65.2%
अस्थिर टेस्ट 2 4
कुल रन 66 66
प्रति परिणाम लागत 1.312 2.135
कुल लागत $0.153 $0.257
इनपुट कीमत $0.966 / 1M $1.400 / 1M
आउटपुट कीमत $3.036 / 1M $4.400 / 1M
कुल इनपुट टोकन 112,458 104,989
आउटपुट टोकन 14,344 8,532
रीजनिंग टोकन 0 16,276
प्रतिक्रिया समय (औसत) 9.65s 13.65s
प्रतिक्रिया समय (अधिकतम) 79.65s 83.60s
प्रतिक्रिया समय (कुल) 212.38s 300.22s
पैरामीटर 744B कुल (40B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#138 GLM 5.2

none
अमान्य SVG
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

#134 GLM 5.3

low
लागत
$0.007
समय
28.4s
टोकन
1,599 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0
GLM 5.3 6.2 6.9 55.6% 1 21.02s 7,317 368 6,764

त्वरित तुलना

तुलना जोड़ी बदलें