AI BENCHY तुलना

Anthropic: Claude Sonnet 4.6 vs Z.ai: GLM 5

सारांश

Claude Sonnet 4.6 vs GLM 5 benchmark तुलना: GLM 5 average score में आगे है: 8.6 vs 7.3. GLM 5 की benchmark लागत कम है: $0.228 vs $0.316. Claude Sonnet 4.6 तेज है: 5.04s vs 33.54s, pass rates 55.6% vs 82.5%.

अनुशंसित मॉडल: GLM 5 - It has the strongest score in this comparison (8.6) and the best overall balance of cost and response time across all 2 models.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-06-18

मेट्रिक	Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17	GLM 5 GLM 5 medium रिलीज़: 2026-02-12

मेट्रिक	Claude Sonnet 4.6 Claude Sonnet 4.6 none रिलीज़: 2026-02-17	GLM 5 GLM 5 medium रिलीज़: 2026-02-12
स्कोर	7.3	8.6
रैंक	#55	#15
विश्वसनीयता	10.0	10.0
संगति	9.7	8.5
सही परीक्षण
प्रति प्रयास पास दर	55.6%	82.5%
अस्थिर टेस्ट	1	4
कुल रन	63	63
प्रति परिणाम लागत	2.870	1.668
कुल लागत	$0.316	$0.228
इनपुट कीमत	$3.000 / 1M	$0.600 / 1M
आउटपुट कीमत	$15.000 / 1M	$1.920 / 1M
कुल इनपुट टोकन	57,886	35,224
आउटपुट टोकन	9,465	21,570
रीजनिंग टोकन	0	102,996
प्रतिक्रिया समय (औसत)	5.04s	33.54s
प्रतिक्रिया समय (अधिकतम)	23.84s	99.85s
प्रतिक्रिया समय (कुल)	70.60s	435.99s

जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#55 Claude Sonnet 4.6

none

लागत: $0.038
समय: 27.3s
टोकन: 2,598 tok

#15 GLM 5

medium

लागत: $0.005
समय: 20.7s
टोकन: 2,068 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	4.8	10.0	25.0%	0		2.94s	636	1,214	0
GLM 5	10.0	10.0	100.0%	0		23.66s	555	480	7,056

कोडिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	5.5	10.0	33.3%	0		5.19s	8,522	2,127	0
GLM 5	10.0	10.0	100.0%	0		74.30s	7,254	2,997	52,930

संयुक्त	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	9.5	10.0	100.0%	0		23.84s	26,024	3,766	0
GLM 5	10.0	10.0	100.0%	0		28.96s	12,804	662	3,242

डेटा पार्सिंग और निष्कर्षण	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	10.0	10.0	100.0%	0		3.43s	8,574	252	0
GLM 5	7.1	5.6	83.3%	1		8.90s	5,508	567	3,734

डोमेन-विशिष्ट	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	7.7	10.0	66.7%	0		3.54s	759	413	0
GLM 5	3.5	4.4	33.3%	2		0ms	260	13,176	14,137

Samanya Buddhimatta	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	6.1	3.1	66.7%	1		2.56s	513	192	0
GLM 5	6.1	3.1	66.7%	1		14.69s	477	2,020	2,248

निर्देश पालन	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	6.5	10.0	50.0%	0		1.96s	690	90	0
GLM 5	10.0	10.0	100.0%	0		7.25s	636	1,001	2,129

पहेली समाधान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	7.7	10.0	66.7%	0		2.53s	663	533	0
GLM 5	10.0	10.0	100.0%	0		11.33s	609	33	4,076

टूल कॉलिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	10.0	10.0	100.0%	0		4.11s	11,301	447	0
GLM 5	10.0	10.0	100.0%	0		15.93s	6,935	233	994

सामान्य ज्ञान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	इनपुट टोकन	आउटपुट टोकन	रीजनिंग टोकन
Claude Sonnet 4.6	3.0	10.0	0.0%	0		4.67s	204	431	0
GLM 5	3.0	10.0	0.0%	0		67.37s	186	401	12,450

त्वरित तुलना

तुलना जोड़ी बदलें