AI BENCHY Compare

OpenAI: GPT-5.3 Chat vs Z.ai: GLM 5 Turbo

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-03-15

Metrică	GPT-5.3 Chat GPT-5.3 Chat none Lansare: 2026-03-03	GLM 5 Turbo GLM 5 Turbo medium Lansare: 2026-03-15

Metrică	GPT-5.3 Chat GPT-5.3 Chat none Lansare: 2026-03-03	GLM 5 Turbo GLM 5 Turbo medium Lansare: 2026-03-15
Rang	#23	#20
Scor	7.8	7.9
Consistență	8.5	7.7
Cost per rezultat	3.163	1.641
Cost total	$0.317	$0.165
Teste corecte
Rată de trecere pe încercare	70.8%	75.0%
Teste instabile	3	5
Rulări totale	48	48
Tokenuri de ieșire	19,272	11,853
Tokenuri de raționament	0	35,095
Timp de răspuns (mediu)	5.96s	18.84s
Timp de răspuns (maxim)	18.33s	194.23s
Timp de răspuns (total)	95.30s	301.50s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.3 Chat	7.9	7.5	77.8%	1		4.72s	3,091	0
GLM 5 Turbo	10.0	10.0	100.0%	0		5.01s	350	2,600

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.3 Chat	10.0	10.0	100.0%	0		11.96s	2,614	0
GLM 5 Turbo	10.0	10.0	100.0%	0		13.88s	390	2,037

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.21s	942	0
GLM 5 Turbo	10.0	10.0	100.0%	0		6.19s	577	3,632

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.3 Chat	3.5	4.4	33.3%	2		13.01s	8,264	0
GLM 5 Turbo	2.9	4.4	22.2%	2		71.07s	9,665	19,279

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.3 Chat	4.6	10.0	0.0%	0		1.99s	319	0
GLM 5 Turbo	6.1	3.1	66.7%	1		10.05s	60	2,216

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.3 Chat	8.3	10.0	50.0%	0		3.29s	1,455	0
GLM 5 Turbo	10.0	10.0	100.0%	0		5.38s	255	2,183

Puzzle Solving	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.93s	1,726	0
GLM 5 Turbo	7.3	5.8	55.6%	2		5.44s	315	2,702

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
GPT-5.3 Chat	10.0	10.0	100.0%	0		8.36s	861	0
GLM 5 Turbo	10.0	10.0	100.0%	0		9.84s	241	446

Comparație rapidă

Schimbă perechea de comparație

GPT-5.3 ChatnonevsQwen3.5-Flashmedium Gemini 3.1 Flash Lite PreviewlowvsGPT-5.3 Chatnone Gemini 3 Flash PreviewnonevsGLM 5 Turbomedium GPT-5.3 ChatnonevsGrok 4.20 Betamedium Gemini 3.1 Flash Lite PreviewlowvsGLM 5 Turbomedium GPT-5.3 ChatnonevsStep 3.5 FlashmediumDisponibil gratuit GPT-5.2 ChatnonevsGLM 5 Turbomedium GPT-5.3 ChatnonevsMiMo-V2-Flashmedium Gemini 3.1 Flash Lite PreviewmediumvsGPT-5.3 Chatnone Seed-2.0-MinimediumvsGPT-5.3 Chatnone Gemini 2.5 FlashmediumvsGPT-5.3 Chatnone Gemini 3.1 Flash Lite PreviewnonevsGLM 5 Turbomedium