नेविगेशन
AI BENCHY
Advertise here

Claude Sonnet 4.6 (medium) vs GLM 5.2 (medium)

average score लगभग बराबर है: 7.8 vs 7.8. GLM 5.2 (medium) की benchmark लागत कम है: $0.176 vs $2.057. GLM 5.2 (medium) तेज है: 23.28s vs 25.91s, pass rates 66.7% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-01

रैंक
#51
कुल आउटपुट टोकन
115,865
प्रतिक्रिया समय (औसत)
25.91s
कुल लागत
$2.057
रैंक
#49
कुल आउटपुट टोकन
61,761
प्रतिक्रिया समय (औसत)
23.28s
कुल लागत
$0.176
अनुशंसित मॉडल GLM 5.2 (medium)

It has the best score here (7.8), while costing about 11.7x less than Claude Sonnet 4.6 (medium).

विस्तृत तुलना

मेट्रिक Claude Sonnet 4.6 Claude Sonnet 4.6 medium रिलीज़: 2026-02-17 GLM 5.2 GLM 5.2 medium रिलीज़: 2026-06-17
स्कोर 7.8 7.8
रैंक #51 #49
विश्वसनीयता 10.0 9.5
संगति 9.2 8.0
सही परीक्षण
प्रति प्रयास पास दर 66.7% 80.3%
अस्थिर टेस्ट 2 4
कुल रन 66 63
प्रति परिणाम लागत 14.692 2.159
कुल लागत $2.057 $0.176
इनपुट कीमत $3.000 / 1M $0.761 / 1M
आउटपुट कीमत $15.000 / 1M $2.389 / 1M
कुल इनपुट टोकन 106,292 37,199
आउटपुट टोकन 80,748 12,261
रीजनिंग टोकन 35,117 49,500
प्रतिक्रिया समय (औसत) 25.91s 23.28s
प्रतिक्रिया समय (अधिकतम) 140.96s 101.36s
प्रतिक्रिया समय (कुल) 362.78s 488.94s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#51 Claude Sonnet 4.6

medium
अमान्य SVG
लागत
$0.000
समय
300.0s
टोकन
0 tok

#49 GLM 5.2

medium
लागत
$0.041
समय
195.8s
टोकन
9,287 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Claude Sonnet 4.6 5.7 6.6 44.4% 1 33.29s 6,995 16,089 3,686
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

त्वरित तुलना

तुलना जोड़ी बदलें