नेविगेशन
Advertise here

Claude Sonnet 5.5 (medium) vs GLM 5

average score लगभग बराबर है: 5.7 vs 5.7. GLM 5 की benchmark लागत कम है: $0.027 vs $0.672. GLM 5 तेज है: 4.03s vs 6.07s, pass rates 37.9% vs 42.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-29

तुलना किए गए मॉडल

रैंक
#266
कुल आउटपुट टोकन
32,980
प्रतिक्रिया समय (औसत)
6.07s
कुल लागत
$0.672
रैंक
#268
कुल आउटपुट टोकन
1,989
प्रतिक्रिया समय (औसत)
4.03s
कुल लागत
$0.027
अनुशंसित मॉडल GLM 5

It has the best score here (5.7), while costing about 25.7x less than Claude Sonnet 5.5 (medium).

विस्तृत तुलना

मेट्रिक Claude Sonnet 5.5 Claude Sonnet 5.5 medium रिलीज़: 2026-09-29 GLM 5 GLM 5 none रिलीज़: 2026-02-12
स्कोर 5.7 5.7
रैंक #266 #268
विश्वसनीयता 10.0 10.0
संगति 9.7 9.3
प्रयास 66/66 63/66
सही परीक्षण
प्रति प्रयास पास दर 37.9% 42.4%
अस्थिर टेस्ट 1 1
कुल रन 66 63
प्रति परिणाम लागत 8.392 0.263
कुल लागत $0.672 $0.027
इनपुट कीमत $2.000 / 1M $0.600 / 1M
आउटपुट कीमत $10.000 / 1M $1.920 / 1M
कुल इनपुट टोकन 170,771 37,135
आउटपुट टोकन 23,185 1,989
रीजनिंग टोकन 9,795 0
प्रतिक्रिया समय (औसत) 6.07s 4.03s
प्रतिक्रिया समय (अधिकतम) 26.16s 11.07s
प्रतिक्रिया समय (कुल) 133.62s 56.37s
पैरामीटर ~1T कुल (~100B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#266 Claude Sonnet 5.5

medium
लागत
$0.024
समय
17.4s
टोकन
2,525 tok

#268 GLM 5

none
लागत
$0.007
समय
32.1s
टोकन
2,023 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 5.5 3.4 9.7 0.0% 0 6.07s 10,608 6,767 0
GLM 5 4.0 7.8 11.1% 1 5.12s 7,256 428 0

त्वरित तुलना

तुलना जोड़ी बदलें