AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Z.ai: GLM 5

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-04-16

Metrică	Claude Opus 4.7 Claude Opus 4.7 medium Lansare: 2026-04-16	GLM 5 GLM 5 none Lansare: 2026-02-12

Metrică	Claude Opus 4.7 Claude Opus 4.7 medium Lansare: 2026-04-16	GLM 5 GLM 5 none Lansare: 2026-02-12
Scor	9.2	6.6
Rang	#3	#52
Consistență	10.0	9.6
Teste corecte
Rată de trecere pe încercare	88.9%	51.9%
Teste instabile	0	1
Rulări totale	54	54
Cost per rezultat	2.790	0.217
Cost total	$0.447	$0.020
Preț de intrare	$5.000 / 1M	$0.720 / 1M
Preț de ieșire	$25.000 / 1M	$2.300 / 1M
Tokenuri de ieșire	5,375	1,959
Tokenuri de raționament	1,341	0
Timp de răspuns (mediu)	3.53s	4.23s
Timp de răspuns (maxim)	21.45s	11.07s
Timp de răspuns (total)	60.03s	46.51s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Claude Opus 4.7	8.3	10.0	75.0%	0		1.85s	348	0
GLM 5	4.8	10.0	25.0%	0		2.37s	275	0

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Claude Opus 4.7	10.0	10.0	100.0%	0		6.41s	1,141	257
GLM 5	5.6	3.5	33.3%	1		8.84s	408	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Claude Opus 4.7	10.0	10.0	100.0%	0		21.45s	2,369	1,084
GLM 5	3.0	10.0	0.0%	0		4.98s	406	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Claude Opus 4.7	10.0	10.0	100.0%	0		2.37s	324	0
GLM 5	10.0	10.0	100.0%	0		5.78s	203	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Claude Opus 4.7	7.7	10.0	66.7%	0		1.17s	51	0
GLM 5	3.0	10.0	0.0%	0		2.24s	19	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Claude Opus 4.7	10.0	10.0	100.0%	0		2.87s	256	0
GLM 5	10.0	10.0	100.0%	0		3.27s	103	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Claude Opus 4.7	10.0	10.0	100.0%	0		1.57s	114	0
GLM 5	10.0	10.0	100.0%	0		1.48s	61	0

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Claude Opus 4.7	10.0	10.0	100.0%	0		2.51s	399	0
GLM 5	7.7	10.0	66.7%	0		2.05s	264	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Claude Opus 4.7	10.0	10.0	100.0%	0		4.17s	373	0
GLM 5	10.0	10.0	100.0%	0		11.07s	220	0

Comparație rapidă

Schimbă perechea de comparație

Grok 4.1 FastmediumvsGLM 5none Nemotron 3 SupermediumDisponibil gratuitvsGLM 5none Mercury 2mediumvsGLM 5none Grok 4.20mediumvsGLM 5none Kimi K2.5mediumvsGLM 5none GPT-5 MinimediumvsGLM 5none GPT-5 NanomediumvsGLM 5none Claude Opus 4.7mediumvsGemini 3 Flash Previewlow GPT-5.4 MinimediumvsGLM 5none Qwen3.5-35B-A3BmediumvsGLM 5none gpt-oss-120bmediumDisponibil gratuitvsGLM 5none MiMo-V2-FlashmediumvsGLM 5none