AI BENCHY Compare

Google: Gemini 2.5 Flash vs Z.ai: GLM 5 Turbo

Resumo

Comparação benchmark Gemini 2.5 Flash vs GLM 5 Turbo: GLM 5 Turbo lidera na pontuação média com 8.4 vs 8.2. GLM 5 Turbo tem menor custo de benchmark com $0.323 vs $0.379. Gemini 2.5 Flash é mais rápido com 15.49s vs 23.00s, com taxas de acerto de 69.8% vs 74.6%.

Modelo recomendado: Gemini 2.5 Flash - Oferece o melhor compromisso geral: pontuação competitiva (8.2), resposta mais rápida que GLM 5 Turbo e custo equilibrado.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-18

Métrica	Gemini 2.5 Flash Gemini 2.5 Flash medium Lançamento: 2025-06-17	GLM 5 Turbo GLM 5 Turbo medium Lançamento: 2026-03-15

Métrica	Gemini 2.5 Flash Gemini 2.5 Flash medium Lançamento: 2025-06-17	GLM 5 Turbo GLM 5 Turbo medium Lançamento: 2026-03-15
Pontuação	8.2	8.4
Posição	#24	#21
Confiabilidade	10.0	10.0
Consistência	9.6	8.5
Testes corretos
Taxa de acerto por tentativa	69.8%	74.6%
Testes instáveis	1	4
Execuções totais	63	63
Custo por resultado	2.701	2.011
Custo total	$0.379	$0.323
Preço de entrada	$0.300 / 1M	$1.200 / 1M
Preço de saída	$2.500 / 1M	$4.000 / 1M
Total de tokens de entrada	34,476	35,593
Tokens de saída	1,930	12,245
Tokens de raciocínio	145,145	62,277
Tempo de resposta (médio)	15.49s	23.00s
Tempo de resposta (máx.)	95.48s	194.23s
Tempo de resposta (total)	325.39s	482.97s

Geração showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#24 Gemini 2.5 Flash

medium

SVG inválido

Custo: $0.000
Tempo: 274.0s
Tokens: 0 tok

#21 GLM 5 Turbo

medium

Custo: $0.074
Tempo: 206.0s
Tokens: 18,549 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Gemini 2.5 Flash	8.4	10.0	75.0%	0		6.30s	492	255	10,233
GLM 5 Turbo	10.0	10.0	100.0%	0		4.82s	555	362	3,137

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Gemini 2.5 Flash	7.8	10.0	66.7%	0		41.01s	6,669	543	32,303
GLM 5 Turbo	8.2	9.3	66.7%	0		45.90s	5,941	363	25,381

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Gemini 2.5 Flash	10.0	10.0	100.0%	0		28.44s	12,522	303	11,922
GLM 5 Turbo	10.0	10.0	100.0%	0		13.88s	12,714	390	2,037

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Gemini 2.5 Flash	10.0	10.0	100.0%	0		4.06s	7,257	279	2,325
GLM 5 Turbo	10.0	10.0	100.0%	0		6.19s	7,107	577	3,632

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Gemini 2.5 Flash	5.9	7.2	55.6%	1		37.34s	633	18	80,702
GLM 5 Turbo	2.9	4.4	22.2%	2		71.07s	489	9,665	19,279

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Gemini 2.5 Flash	4.8	10.0	0.0%	0		4.86s	486	92	1,899
GLM 5 Turbo	6.1	3.1	66.7%	1		10.05s	477	60	2,216

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Gemini 2.5 Flash	9.8	10.0	100.0%	0		2.62s	615	69	1,203
GLM 5 Turbo	10.0	10.0	100.0%	0		5.38s	636	255	2,183

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Gemini 2.5 Flash	7.7	10.0	66.7%	0		3.18s	558	126	2,499
GLM 5 Turbo	8.7	7.9	77.8%	1		5.23s	609	312	2,647

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Gemini 2.5 Flash	10.0	10.0	100.0%	0		6.20s	5,088	234	1,140
GLM 5 Turbo	10.0	10.0	100.0%	0		9.84s	6,879	241	446

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Gemini 2.5 Flash	3.0	10.0	0.0%	0		2.76s	156	11	919
GLM 5 Turbo	3.0	10.0	0.0%	0		40.17s	186	20	1,319

Comparação rápida

Trocar par de comparação