AI BENCHY Compare

MoonshotAI: Kimi K2.6 vs Elephant Alpha

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-04

Métrica	Kimi K2.6 Kimi K2.6 none Lançamento: 2026-04-20 Disponível grátis	Elephant Alpha Elephant Alpha medium Lançamento: 2026-04-14

Métrica	Kimi K2.6 Kimi K2.6 none Lançamento: 2026-04-20 Disponível grátis	Elephant Alpha Elephant Alpha medium Lançamento: 2026-04-14
Pontuação	5.5	5.1
Posição	#124	#136
Confiabilidade	10.0	N/D
Consistência	9.2	9.7
Testes corretos
Taxa de acerto por tentativa	36.5%	30.2%
Testes instáveis	2	1
Execuções totais	63	63
Custo por resultado	1.267	0.000
Custo total	$0.079	$0.000
Preço de entrada	$0.684 / 1M	$0.000 / 1M
Preço de saída	$3.420 / 1M	$0.000 / 1M
Total de tokens de entrada	32,916	33,744
Tokens de saída	16,410	2,596
Tokens de raciocínio	0	0
Tempo de resposta (médio)	13.27s	1.27s
Tempo de resposta (máx.)	238.89s	3.70s
Tempo de resposta (total)	278.57s	22.82s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.6	4.6	10.0	25.0%	0		1.39s	618	471	0
Elephant Alpha	6.6	10.0	50.0%	0		1.19s	726	815	0

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.6	5.5	9.8	33.3%	0		82.57s	5,986	14,754	0
Elephant Alpha	3.7	7.8	11.1%	1		1.30s	813	365	0

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.6	3.0	10.0	0.0%	0		3.38s	11,269	290	0
Elephant Alpha	3.0	10.0	0.0%	0		3.70s	14,046	562	0

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.6	10.0	10.0	100.0%	0		1.32s	7,014	201	0
Elephant Alpha	6.5	10.0	50.0%	0		979ms	8,004	246	0

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.6	5.3	7.2	44.4%	1		1.48s	732	42	0
Elephant Alpha	3.0	10.0	0.0%	0		925ms	810	24	0

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.6	5.4	3.5	33.3%	1		1.55s	477	138	0
Elephant Alpha	4.3	10.0	0.0%	0		920ms	540	105	0

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.6	6.5	10.0	50.0%	0		1.64s	669	72	0
Elephant Alpha	9.8	10.0	100.0%	0		987ms	732	82	0

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.6	3.1	9.9	0.0%	0		1.40s	651	185	0
Elephant Alpha	5.3	10.0	33.3%	0		868ms	729	166	0

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.6	10.0	10.0	100.0%	0		4.46s	5,286	240	0
Elephant Alpha	3.0	10.0	0.0%	0		2.83s	7,344	231	0

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Kimi K2.6	3.0	10.0	0.0%	0		1.36s	214	17	0
Elephant Alpha	3.0	10.0	0.0%	0		0ms	0	0	0

Comparação rápida

Trocar par de comparação

Kimi K2.5nonevsElephant Alphamedium Ling-2.6-flashnonevsElephant Alphamedium Elephant AlphamediumvsGLM 5 Turbonone DeepSeek V3.2nonevsElephant Alphamedium MiniMax M2.5mediumvsKimi K2.6noneDisponível grátis DeepSeek V4 FlashnonevsElephant Alphamedium CobuddymediumvsKimi K2.6noneDisponível grátis MiniMax M2.7mediumvsKimi K2.6noneDisponível grátis Elephant AlphamediumvsQwen3.5-122B-A10Bnone Mistral Small 4mediumvsKimi K2.6noneDisponível grátis Elephant AlphamediumvsQwen3 Coder Nextnone Nemotron 3 SupernoneDisponível grátisvsElephant Alphamedium