AI BENCHY Compare

Anthropic: Claude Opus 4.8 vs Z.ai: GLM 5V Turbo

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-05-28

Métrica	Claude Opus 4.8 Claude Opus 4.8 none Lançamento: 2026-05-28	GLM 5V Turbo GLM 5V Turbo medium Lançamento: 2026-04-01

Métrica	Claude Opus 4.8 Claude Opus 4.8 none Lançamento: 2026-05-28	GLM 5V Turbo GLM 5V Turbo medium Lançamento: 2026-04-01
Pontuação	7.3	7.4
Posição	#63	#60
Confiabilidade	10.0	10.0
Consistência	9.2	8.2
Testes corretos
Taxa de acerto por tentativa	65.0%	68.3%
Testes instáveis	2	5
Execuções totais	60	60
Custo por resultado	4.324	3.695
Custo total	$0.519	$0.407
Preço de entrada	$5.000 / 1M	$1.200 / 1M
Preço de saída	$25.000 / 1M	$4.000 / 1M
Tokens de saída	8,098	2,334
Tokens de raciocínio	0	86,653
Tempo de resposta (médio)	3.51s	20.21s
Tempo de resposta (máx.)	17.73s	95.88s
Tempo de resposta (total)	70.19s	404.14s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	6.5	10.0	50.0%	0		3.40s	1,472	0
GLM 5V Turbo	7.2	6.1	75.0%	2		10.76s	587	7,872

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	6.8	10.0	50.0%	0		3.59s	1,323	0
GLM 5V Turbo	6.8	10.0	50.0%	0		54.83s	427	26,111

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	9.5	10.0	100.0%	0		17.73s	3,259	0
GLM 5V Turbo	6.9	3.8	66.7%	1		15.06s	403	2,523

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	7.3	5.8	83.3%	1		1.77s	308	0
GLM 5V Turbo	10.0	10.0	100.0%	0		9.60s	236	4,333

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	5.3	7.2	44.4%	1		1.66s	61	0
GLM 5V Turbo	5.3	7.2	44.4%	1		38.15s	32	29,035

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	10.0	10.0	100.0%	0		3.48s	230	0
GLM 5V Turbo	10.0	10.0	100.0%	0		11.09s	131	2,183

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	9.9	10.0	100.0%	0		1.37s	95	0
GLM 5V Turbo	9.9	10.0	100.0%	0		3.74s	72	1,813

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	7.7	10.0	66.7%	0		2.74s	783	0
GLM 5V Turbo	7.7	10.0	66.7%	0		10.24s	131	4,496

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	10.0	10.0	100.0%	0		5.35s	355	0
GLM 5V Turbo	7.0	3.7	66.7%	1		12.53s	293	765

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.8	3.0	10.0	0.0%	0		3.41s	212	0
GLM 5V Turbo	3.0	10.0	0.0%	0		40.96s	22	7,522

Comparação rápida

Trocar par de comparação

Claude Opus 4.8nonevsQwen3.5-35B-A3Bmedium Claude Opus 4.8nonevsRing-2.6-1Tmedium Claude Opus 4.8nonevsGPT-5.4 Minimedium Claude Opus 4.8nonevsGPT-5.2medium GPT-5.3 ChatnonevsGLM 5V Turbomedium Gemini 3.1 Flash LitelowvsGLM 5V Turbomedium Claude Opus 4.8nonevsGPT-5.4 Nanomedium Gemini 3.1 Flash Lite PreviewnonevsGLM 5V Turbomedium Claude Opus 4.8nonevsStep 3.5 Flashmedium Claude Opus 4.8nonevsGPT-5 Minimedium Ring-2.6-1TnonevsGLM 5V Turbomedium Claude Opus 4.8nonevsKimi K2.6mediumDisponível grátis