AI BENCHY Compare

Z.ai: GLM 4.7 Flash vs GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-04-02

Métrica	GLM 4.7 Flash GLM 4.7 Flash medium Lançamento: 2026-01-19	GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT none Lançamento: Data de lançamento desconhecida

Métrica	GLM 4.7 Flash GLM 4.7 Flash medium Lançamento: 2026-01-19	GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT none Lançamento: Data de lançamento desconhecida
Pontuação	4.7	3.0
Posição	#82	#88
Consistência	6.6	10.0
Testes corretos
Taxa de acerto por tentativa	39.2%	0.0%
Testes instáveis	7	0
Execuções totais	51	48
Custo por resultado	1.046	0.000
Custo total	$0.042	$0.000
Preço de entrada	$0.060 / 1M	$0.000 / 1M
Preço de saída	$0.400 / 1M	$0.000 / 1M
Tokens de saída	38,719	0
Tokens de raciocínio	65,465	0
Tempo de resposta (médio)	33.44s	0ms
Tempo de resposta (máx.)	174.55s	0ms
Tempo de resposta (total)	334.39s	0ms

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GLM 4.7 Flash	4.7	5.9	41.7%	2		14.95s	1,122	6,110
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GLM 4.7 Flash	2.8	2.1	33.3%	1		65.57s	2,585	20,648
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GLM 4.7 Flash	6.3	10.0	50.0%	0		1.51s	584	2,755
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GLM 4.7 Flash	3.5	4.4	33.3%	2		174.55s	33,000	25,394
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GLM 4.7 Flash	3.6	9.7	0.0%	0		18.14s	18	2,138
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GLM 4.7 Flash	6.2	5.8	66.7%	1		2.97s	388	2,181
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Puzzle Solving	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GLM 4.7 Flash	2.9	7.2	11.1%	1		12.90s	798	5,225
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
GLM 4.7 Flash	10.0	10.0	100.0%	0		15.95s	224	1,014
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Comparação rápida

Trocar par de comparação

Qwen3.5-9BnonevsGLM 4.7 Flashmedium GPT-5.4 MininonevsGLM 4.7 Flashmedium Mercury 2nonevsGLM 4.7 Flashmedium Grok 4.1 FastnonevsGLM 4.7 Flashmedium MiMo-V2-FlashnonevsGLM 4.7 Flashmedium Qwen3 Coder NextnonevsGLM 4.7 Flashmedium GPT-4o-mininonevsGLM 4.7 Flashmedium GPT-5.4 NanononevsGLM 4.7 Flashmedium Nemotron 3 SupernoneDisponível grátisvsGLM 4.7 Flashmedium Mistral Small 4nonevsGLM 4.7 Flashmedium Trinity Large PreviewnoneDisponível grátisvsGLM 4.7 Flashmedium Kimi K2.5nonevsGLM 4.7 Flashmedium