AI BENCHY Compare

OpenAI: GPT-5.4 vs Z.ai: GLM 5.1

Benchmark zimetengenezwa kutoka seti za majaribio za AI BENCHY tarehe: 2026-04-07

Kipimo	GPT-5.4 GPT-5.4 none Toleo: 2026-03-05	GLM 5.1 GLM 5.1 none Toleo: 2026-04-07

Kipimo	GPT-5.4 GPT-5.4 none Toleo: 2026-03-05	GLM 5.1 GLM 5.1 none Toleo: 2026-04-07
Alama	5.6	5.6
Nafasi	#68	#67
Uthabiti	9.0	8.2
Majaribio sahihi
Kiwango cha kupita kwa kila jaribio	39.2%	39.2%
Majaribio yasiyo thabiti	2	4
Jumla ya uendeshaji	51	51
Gharama kwa matokeo	1.573	1.000
Jumla ya gharama	$0.095	$0.050
Bei ya ingizo	$2.500 / 1M	$1.000 / 1M
Bei ya toleo	$15.000 / 1M	$3.200 / 1M
Tokeni za matokeo	1,837	3,219
Tokeni za hoja	0	0
Muda wa majibu (wastani)	1.43s	4.01s
Muda wa majibu (upeo)	2.89s	32.57s
Muda wa majibu (jumla)	24.27s	68.23s

Modeli bora kwa alama

Alama dhidi ya gharama ya jumla

Muda wa majibu (wastani)

Alama vs Muda wa majibu (wastani)

Jumla ya tokeni za matokeo

Alama vs Jumla ya tokeni za matokeo

Mgawanyo wa kategoria

Mbinu za kupinga AI	Alama	Uthabiti	Kiwango cha kupita kwa kila jaribio	Majaribio yasiyo thabiti	Majaribio sahihi	Muda wa majibu (wastani)	Tokeni za matokeo	Tokeni za hoja
GPT-5.4	3.2	8.0	8.3%	1		1.21s	406	0
GLM 5.1	4.0	6.3	25.0%	2		2.11s	305	0

Mchanganyiko	Alama	Uthabiti	Kiwango cha kupita kwa kila jaribio	Majaribio yasiyo thabiti	Majaribio sahihi	Muda wa majibu (wastani)	Tokeni za matokeo	Tokeni za hoja
GPT-5.4	3.0	10.0	0.0%	0		2.89s	291	0
GLM 5.1	2.8	2.1	33.3%	1		32.57s	2,129	0

Uchanganuzi na uchimbaji wa data	Alama	Uthabiti	Kiwango cha kupita kwa kila jaribio	Majaribio yasiyo thabiti	Majaribio sahihi	Muda wa majibu (wastani)	Tokeni za matokeo	Tokeni za hoja
GPT-5.4	10.0	10.0	100.0%	0		1.04s	222	0
GLM 5.1	10.0	10.0	100.0%	0		1.08s	204	0

Mahususi kwa domeni	Alama	Uthabiti	Kiwango cha kupita kwa kila jaribio	Majaribio yasiyo thabiti	Majaribio sahihi	Muda wa majibu (wastani)	Tokeni za matokeo	Tokeni za hoja
GPT-5.4	5.3	7.2	44.4%	1		1.07s	50	0
GLM 5.1	2.9	7.2	11.1%	1		1.99s	24	0

Akili ya jumla	Alama	Uthabiti	Kiwango cha kupita kwa kila jaribio	Majaribio yasiyo thabiti	Majaribio sahihi	Muda wa majibu (wastani)	Tokeni za matokeo	Tokeni za hoja
GPT-5.4	4.4	9.9	0.0%	0		1.78s	184	0
GLM 5.1	5.0	10.0	0.0%	0		790ms	39	0

Ufuataji wa maagizo	Alama	Uthabiti	Kiwango cha kupita kwa kila jaribio	Majaribio yasiyo thabiti	Majaribio sahihi	Muda wa majibu (wastani)	Tokeni za matokeo	Tokeni za hoja
GPT-5.4	6.5	10.0	50.0%	0		1.07s	81	0
GLM 5.1	8.3	10.0	50.0%	0		1.58s	66	0

Puzzle Solving	Alama	Uthabiti	Kiwango cha kupita kwa kila jaribio	Majaribio yasiyo thabiti	Majaribio sahihi	Muda wa majibu (wastani)	Tokeni za matokeo	Tokeni za hoja
GPT-5.4	5.6	9.8	33.3%	0		1.52s	357	0
GLM 5.1	5.7	10.0	33.3%	0		1.48s	152	0

Mwito wa zana	Alama	Uthabiti	Kiwango cha kupita kwa kila jaribio	Majaribio yasiyo thabiti	Majaribio sahihi	Muda wa majibu (wastani)	Tokeni za matokeo	Tokeni za hoja
GPT-5.4	10.0	10.0	100.0%	0		2.75s	246	0
GLM 5.1	10.0	10.0	100.0%	0		10.68s	300	0

Ulinganisho wa haraka

Badilisha jozi ya ulinganisho

Mistral Small 4mediumvsGPT-5.4none Mistral Small 4mediumvsGLM 5.1none MiniMax M2.5mediumInapatikana burevsGLM 5.1none MiniMax M2.5mediumInapatikana burevsGPT-5.4none gpt-oss-120bmediumInapatikana burevsGLM 5.1none Grok 4.20 Multi Agent BetamediumvsGLM 5.1none GPT-5.4nonevsGrok 4.20 Multi Agent Betamedium GPT-5 NanomediumvsGLM 5.1none MiniMax M2.7mediumvsGPT-5.4none MiniMax M2.7mediumvsGLM 5.1none Mercury 2mediumvsGLM 5.1none Mercury 2mediumvsGPT-5.4none