AI BENCHY तुलना

xAI: Grok 4.3 vs Z.ai: GLM 5

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-05-01

मेट्रिक	Grok 4.3 Grok 4.3 medium रिलीज़: 2026-05-01	GLM 5 GLM 5 medium रिलीज़: 2026-02-12

मेट्रिक	Grok 4.3 Grok 4.3 medium रिलीज़: 2026-05-01	GLM 5 GLM 5 medium रिलीज़: 2026-02-12
स्कोर	8.2	8.4
रैंक	#20	#18
विश्वसनीयता	10.0	लागू नहीं
संगति	8.6	8.2
सही परीक्षण
प्रति प्रयास पास दर	81.5%	85.2%
अस्थिर टेस्ट	3	4
कुल रन	54	54
प्रति परिणाम लागत	3.974	1.188
कुल लागत	$0.517	$0.155
???? ???	$1.250 / 1M	$0.600 / 1M
????? ???	$2.500 / 1M	$2.080 / 1M
आउटपुट टोकन	1,223	20,163
रीजनिंग टोकन	187,047	58,337
प्रतिक्रिया समय (औसत)	48.63s	23.34s
प्रतिक्रिया समय (अधिकतम)	216.69s	79.09s
प्रतिक्रिया समय (कुल)	875.27s	233.40s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Grok 4.3	10.0	10.0	100.0%	0		8.83s	88	8,207
GLM 5	10.0	10.0	100.0%	0		23.66s	480	7,056

कोडिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Grok 4.3	10.0	10.0	100.0%	0		45.72s	284	9,659
GLM 5	10.0	10.0	100.0%	0		79.09s	330	19,814

संयुक्त	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Grok 4.3	10.0	10.0	100.0%	0		63.99s	234	15,301
GLM 5	10.0	10.0	100.0%	0		28.96s	662	3,242

डेटा पार्सिंग और निष्कर्षण	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Grok 4.3	10.0	10.0	100.0%	0		18.97s	180	9,546
GLM 5	7.1	5.6	83.3%	1		8.90s	567	3,734

डोमेन-विशिष्ट	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Grok 4.3	5.3	7.2	44.4%	1		181.74s	14	111,300
GLM 5	3.5	4.4	33.3%	2		0ms	13,176	14,137

Samanya Buddhimatta	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Grok 4.3	5.4	2.5	66.7%	1		24.70s	70	5,020
GLM 5	6.1	3.1	66.7%	1		14.69s	2,020	2,248

निर्देश पालन	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Grok 4.3	9.8	10.0	100.0%	0		18.58s	57	8,713
GLM 5	10.0	10.0	100.0%	0		7.25s	1,001	2,129

पहेली समाधान	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Grok 4.3	5.9	7.2	55.6%	1		22.53s	128	14,686
GLM 5	10.0	10.0	100.0%	0		15.64s	1,694	4,983

टूल कॉलिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
Grok 4.3	10.0	10.0	100.0%	0		17.66s	168	4,615
GLM 5	10.0	10.0	100.0%	0		15.93s	233	994

त्वरित तुलना

तुलना जोड़ी बदलें

HY3 Previewlowनिःशुल्क उपलब्धvsGrok 4.3medium Gemini 3 Flash PreviewnonevsGrok 4.3medium Gemini 3.1 Flash Lite PreviewlowvsGrok 4.3medium HY3 Previewhighनिःशुल्क उपलब्धvsGLM 5medium HY3 Previewlowनिःशुल्क उपलब्धvsGLM 5medium Gemini 3 Flash PreviewnonevsGLM 5medium Gemini 3.1 Flash Lite PreviewlowvsGLM 5medium GPT-5.2 ChatnonevsGrok 4.3medium Gemini 3.1 Flash Lite PreviewnonevsGrok 4.3medium GPT-5.3 ChatnonevsGrok 4.3medium HY3 Previewhighनिःशुल्क उपलब्धvsGrok 4.3medium DeepSeek V4 FlashhighvsGrok 4.3medium