Compară Grafice Metodologie

Limbă:

❤️ Made by XCS

AI BENCHY Compare

OpenAI: GPT-5.4 vs Z.ai: GLM 5

Compară:

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-03-06

Metrică	OpenAI: GPT-5.4 medium Lansare: 2026-03-05	Z.ai: GLM 5 none Lansare: 2026-02-12
Rang	#9	#31
Scor mediu	8.0	6.0
Consistență	8.5	10.0
Cost per rezultat	6.601	0.200
Cost total	$0.793	$0.018
Teste corecte
Rată de trecere pe încercare	83.3%	56.3%
Teste instabile	3	0
Rulări totale	48 (16 x 3)	48 (16 x 3)
Tokenuri de ieșire	1,756	1,548
Tokenuri de raționament	46,642	0
Timp de răspuns (mediu)	20.05s	4.03s
Timp de răspuns (maxim)	100.41s	11.07s
Timp de răspuns (total)	320.87s	36.30s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor mediu vs Timp de răspuns (mediu)

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
OpenAI: GPT-5.4	10.0	10.0	100.0%	0		5.02s	216	1,466
Z.ai: GLM 5	4.0	10.0	33.3%	0		3.39s	272	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
OpenAI: GPT-5.4	10.0	10.0	100.0%	0		20.57s	301	3,543
Z.ai: GLM 5	10.0	10.0	0.0%	0		4.98s	406	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
OpenAI: GPT-5.4	9.9	10.0	100.0%	0		5.32s	234	804
Z.ai: GLM 5	9.9	10.0	100.0%	0		5.78s	203	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
OpenAI: GPT-5.4	4.0	7.2	44.4%	1		74.27s	61	34,748
Z.ai: GLM 5	10.0	10.0	0.0%	0		2.24s	19	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
OpenAI: GPT-5.4	5.0	3.1	33.3%	1		4.92s	145	321
Z.ai: GLM 5	10.0	10.0	100.0%	0		3.27s	103	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
OpenAI: GPT-5.4	10.0	10.0	100.0%	0		3.11s	93	897
Z.ai: GLM 5	10.0	10.0	100.0%	0		1.48s	61	0

Puzzle Solving	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
OpenAI: GPT-5.4	7.0	7.2	88.9%	1		9.13s	442	3,832
Z.ai: GLM 5	7.0	10.0	66.7%	0		2.05s	264	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
OpenAI: GPT-5.4	10.0	10.0	100.0%	0		13.28s	264	1,031
Z.ai: GLM 5	10.0	10.0	100.0%	0		11.07s	220	0

Comparație rapidă

Schimbă perechea de comparație

GPT-5 MinimediumvsGLM 5none Gemini 3.1 Flash Lite PreviewhighvsGPT-5.4medium Gemini 3 Flash PreviewlowvsGPT-5.4medium Grok 4.1 FastmediumvsGLM 5none Kimi K2.5mediumvsGLM 5none GPT-5 NanomediumvsGLM 5none GPT-5.2mediumvsGLM 5none Qwen3.5-35B-A3BmediumvsGLM 5none Claude Opus 4.6mediumvsGLM 5none Mercury 2mediumvsGLM 5none Gemini 3.1 Flash Lite PreviewlowvsGPT-5.4medium Gemini 3 Flash PreviewnonevsGPT-5.4medium