AI BENCHY Compare

MoonshotAI: Kimi K2.7 Code vs Z.ai: GLM 5.2

Resumo

Comparação benchmark Kimi K2.7 Code vs GLM 5.2: GLM 5.2 lidera na pontuação média com 7.1 vs 7.0. GLM 5.2 tem menor custo de benchmark com $0.076 vs $0.583. GLM 5.2 é mais rápido com 6.34s vs 83.60s, com taxas de acerto de 66.7% vs 60.3%.

Modelo recomendado: GLM 5.2 - Tem a melhor pontuação aqui (7.1) e custa cerca de 7.7x menos que Kimi K2.7 Code.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-17

Métrica	Kimi K2.7 Code Kimi K2.7 Code medium Lançamento: 2026-06-12	GLM 5.2 GLM 5.2 none Lançamento: 2026-06-17

Métrica	Kimi K2.7 Code Kimi K2.7 Code medium Lançamento: 2026-06-12	GLM 5.2 GLM 5.2 none Lançamento: 2026-06-17
Pontuação	7.0	7.1
Posição	#65	#61
Confiabilidade	9.2	9.9
Consistência	7.7	9.6
Testes corretos
Taxa de acerto por tentativa	66.7%	60.3%
Testes instáveis	6	1
Execuções totais	63	63
Custo por resultado	6.074	0.628
Custo total	$0.583	$0.076
Preço de entrada	$0.740 / 1M	$1.400 / 1M
Preço de saída	$3.500 / 1M	$4.400 / 1M
Total de tokens de entrada	25,991	38,671
Tokens de saída	80,516	4,817
Tokens de raciocínio	161,391	0
Tempo de resposta (médio)	83.60s	6.34s
Tempo de resposta (máx.)	365.80s	20.69s
Tempo de resposta (total)	1671.99s	133.19s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#65 MoonshotAI: Kimi K2.7 Code

medium

Cost: $0.025
Time: 138.0s
Tokens: 6,093 tok

#61 GLM 5.2

none

Invalid SVG

Cost: $0.033
Time: 87.7s
Tokens: 7,455 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.7 Code	7.3	5.8	83.3%	2		11.56s	618	3,048	5,041
GLM 5.2	8.3	10.0	75.0%	0		3.70s	567	313	0

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.7 Code	7.6	7.2	77.8%	1		146.73s	4,650	1,864	25,635
GLM 5.2	3.7	9.5	0.0%	0		7.55s	7,263	1,958	0

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.7 Code	4.7	1.6	66.7%	1		34.83s	11,271	444	3,906
GLM 5.2	10.0	10.0	100.0%	0		20.69s	14,296	1,489	0

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.7 Code	10.0	10.0	100.0%	0		12.27s	7,014	248	2,569
GLM 5.2	10.0	10.0	100.0%	0		7.17s	7,113	204	0

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.7 Code	5.3	7.2	44.4%	1		213.29s	431	55,572	63,639
GLM 5.2	5.3	10.0	33.3%	0		6.50s	696	27	0

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.7 Code	10.0	10.0	100.0%	0		10.78s	477	1,024	1,071
GLM 5.2	6.1	3.1	66.7%	1		4.42s	480	82	0

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.7 Code	9.9	10.0	100.0%	0		5.39s	669	725	1,232
GLM 5.2	9.8	10.0	100.0%	0		3.84s	642	66	0

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.7 Code	5.9	7.7	44.4%	1		41.00s	651	15,438	17,368
GLM 5.2	7.7	10.0	66.7%	0		3.31s	618	265	0

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.7 Code	3.0	10.0	0.0%	0		0ms	0	0	0
GLM 5.2	10.0	10.0	100.0%	0		15.76s	6,807	400	0

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.7 Code	3.0	10.0	0.0%	0		341.76s	210	2,153	40,930
GLM 5.2	3.0	10.0	0.0%	0		3.41s	189	13	0

Comparação rápida

Trocar par de comparação

Gemini 3.5 FlashnonevsKimi K2.7 Codemedium Gemma 4 26B A4BmediumDisponível grátisvsGLM 5.2none MiMo-V2-FlashmediumvsGLM 5.2none Step 3.7 FlashhighvsGLM 5.2none Kimi K2.7 CodemediumvsStep 3.7 Flashhigh Gemini 3 Flash PreviewnonevsKimi K2.7 Codemedium Kimi K2.7 CodemediumvsQwen3.7 Maxnone Kimi K2.7 CodemediumvsQwen3.7 Plusnone DeepSeek V4 PrononevsKimi K2.7 Codemedium Gemini 3.5 FlashminimalvsKimi K2.7 Codemedium Grok 4.20mediumvsGLM 5.2none Claude Opus 4.8nonevsKimi K2.7 Codemedium