AI BENCHY तुलना

OpenAI: GPT-5.2 Chat vs Z.ai: GLM 5.1

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-04-07

मेट्रिक	GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11	GLM 5.1 GLM 5.1 medium रिलीज़: 2026-04-07

मेट्रिक	GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11	GLM 5.1 GLM 5.1 medium रिलीज़: 2026-04-07
स्कोर	7.8	8.0
रैंक	#31	#23
संगति	8.6	9.0
सही परीक्षण
प्रति प्रयास पास दर	74.5%	76.5%
अस्थिर टेस्ट	3	2
कुल रन	51	51
प्रति परिणाम लागत	2.462	1.270
कुल लागत	$0.271	$0.153
???? ???	$1.750 / 1M	$1.000 / 1M
????? ???	$14.000 / 1M	$3.200 / 1M
आउटपुट टोकन	16,001	6,666
रीजनिंग टोकन	0	35,313
प्रतिक्रिया समय (औसत)	6.72s	18.23s
प्रतिक्रिया समय (अधिकतम)	38.52s	43.11s
प्रतिक्रिया समय (कुल)	114.20s	291.73s

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

एंटी-एआई ट्रिक्स	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	8.7	7.9	91.7%	1		3.40s	1,807	0
GLM 5.1	10.0	10.0	100.0%	0		8.31s	401	5,122

संयुक्त	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	10.0	10.0	100.0%	0		9.12s	1,243	0
GLM 5.1	9.5	10.0	100.0%	0		43.11s	327	4,206

डेटा पार्सिंग और निष्कर्षण	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	10.0	10.0	100.0%	0		3.05s	980	0
GLM 5.1	10.0	10.0	100.0%	0		9.33s	991	4,552

डोमेन-विशिष्ट	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	5.3	10.0	33.3%	0		17.78s	7,810	0
GLM 5.1	5.3	10.0	33.3%	0		29.77s	969	11,314

Samanya Buddhimatta	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	4.4	3.0	33.3%	1		3.20s	335	0
GLM 5.1	10.0	10.0	100.0%	0		20.95s	2,875	2,875

निर्देश पालन	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	7.5	6.1	83.3%	1		5.46s	1,528	0
GLM 5.1	6.4	5.8	66.7%	1		7.47s	204	1,617

Puzzle Solving	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	7.7	10.0	66.7%	0		4.42s	1,743	0
GLM 5.1	8.2	7.2	88.9%	1		23.85s	899	5,627

टूल कॉलिंग	स्कोर	संगति	प्रति प्रयास पास दर	अस्थिर टेस्ट	सही परीक्षण	प्रतिक्रिया समय (औसत)	आउटपुट टोकन	रीजनिंग टोकन
GPT-5.2 Chat	10.0	10.0	100.0%	0		4.68s	555	0
GLM 5.1	3.0	10.0	0.0%	0		0ms	0	0

त्वरित तुलना

तुलना जोड़ी बदलें

Gemini 3 Flash PreviewnonevsGLM 5.1medium Gemini 3.1 Flash Lite PreviewlowvsGLM 5.1medium GPT-5.2 ChatnonevsStep 3.5 Flashmediumनिःशुल्क उपलब्ध GPT-5.2 ChatnonevsGLM 5V Turbomedium GPT-5.2 ChatnonevsGrok 4.20 Betamedium GPT-5.2 ChatnonevsMiMo-V2-Omnimedium Claude Sonnet 4.6mediumvsGPT-5.2 Chatnone GPT-5.2 ChatnonevsMiMo-V2-Promedium Gemini 3.1 Flash Lite PreviewnonevsGLM 5.1medium GPT-5.2 ChatnonevsQwen3.5-Flashmedium GPT-5.2 ChatnonevsMiMo-V2-Flashmedium Gemini 3.1 Flash Lite PreviewlowvsGPT-5.2 Chatnone