AI BENCHY Compare

OpenAI: GPT-5.4 Nano vs Z.ai: GLM 5.2

Rezumat

Comparație benchmark GPT-5.4 Nano vs GLM 5.2: GPT-5.4 Nano conduce la scorul mediu cu 7.5 vs 7.1. GLM 5.2 are costul de benchmark mai mic, $0.076 vs $0.107. GLM 5.2 este mai rapid cu 6.34s vs 11.95s, cu rate de reușită de 63.5% vs 60.3%.

Model recomandat: GLM 5.2 - Scorul rămâne aproape de cel mai bun scor de aici (7.1 vs 7.5) și răspunde de aproximativ 1.9x mai rapid decât GPT-5.4 Nano.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-18

Metrică	GPT-5.4 Nano GPT-5.4 Nano medium Lansare: 2026-03-17	GLM 5.2 GLM 5.2 none Lansare: 2026-06-17

Metrică	GPT-5.4 Nano GPT-5.4 Nano medium Lansare: 2026-03-17	GLM 5.2 GLM 5.2 none Lansare: 2026-06-17
Scor	7.5	7.1
Rang	#46	#61
Fiabilitate	10.0	9.9
Consistență	8.4	9.6
Teste corecte
Rată de trecere pe încercare	63.5%	60.3%
Teste instabile	4	1
Rulări totale	63	63
Cost per rezultat	0.969	0.628
Cost total	$0.107	$0.076
Preț de intrare	$0.200 / 1M	$1.400 / 1M
Preț de ieșire	$1.250 / 1M	$4.400 / 1M
Total tokenuri de intrare	35,434	38,671
Tokenuri de ieșire	3,014	4,817
Tokenuri de raționament	76,520	0
Timp de răspuns (mediu)	11.95s	6.34s
Timp de răspuns (maxim)	94.06s	20.69s
Timp de răspuns (total)	250.98s	133.19s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#46 GPT-5.4 Nano

medium

Cost: $0.007
Timp: 24.6s
Tokenuri: 4,943 tok

#61 GLM 5.2

none

SVG invalid

Cost: $0.033
Timp: 87.7s
Tokenuri: 7,455 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Nano	8.3	10.0	75.0%	0		4.52s	606	683	2,254
GLM 5.2	8.3	10.0	75.0%	0		3.70s	567	313	0

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Nano	6.1	4.7	66.7%	2		19.12s	7,305	516	20,778
GLM 5.2	3.7	9.5	0.0%	0		7.55s	7,263	1,958	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Nano	9.8	10.0	100.0%	0		24.13s	12,345	349	5,719
GLM 5.2	10.0	10.0	100.0%	0		20.69s	14,296	1,489	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Nano	10.0	10.0	100.0%	0		2.54s	7,140	234	516
GLM 5.2	10.0	10.0	100.0%	0		7.17s	7,113	204	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Nano	5.9	7.2	55.6%	1		38.18s	619	60	43,325
GLM 5.2	5.3	10.0	33.3%	0		6.50s	696	27	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Nano	4.5	10.0	0.0%	0		4.15s	477	179	443
GLM 5.2	6.1	3.1	66.7%	1		4.42s	480	82	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Nano	9.8	10.0	100.0%	0		1.88s	660	95	521
GLM 5.2	9.8	10.0	100.0%	0		3.84s	642	66	0

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Nano	4.1	7.2	22.2%	1		3.79s	642	594	1,408
GLM 5.2	7.7	10.0	66.7%	0		3.31s	618	265	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Nano	10.0	10.0	100.0%	0		7.71s	5,445	234	382
GLM 5.2	10.0	10.0	100.0%	0		15.76s	6,807	400	0

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.4 Nano	3.0	10.0	0.0%	0		4.81s	195	70	1,174
GLM 5.2	3.0	10.0	0.0%	0		3.41s	189	13	0

Comparație rapidă

Schimbă perechea de comparație

Gemma 4 26B A4BmediumDisponibil gratuitvsGLM 5.2none Step 3.7 FlashhighvsGLM 5.2none DeepSeek V4 ProhighvsGPT-5.4 Nanomedium Kimi K2.7 CodemediumvsGLM 5.2none Gemini 3 Flash PreviewlowvsGPT-5.4 Nanomedium GPT-5.4 NanomediumvsStep 3.7 Flashlow Claude Sonnet 4.6nonevsGPT-5.4 Nanomedium Grok 4.20mediumvsGLM 5.2none Gemini 3 Flash PreviewlowvsGLM 5.2none MiMo-V2.5-PromediumvsGLM 5.2none Claude Opus 4.8nonevsGPT-5.4 Nanomedium Seed-2.0-MinimediumvsGLM 5.2none