AI BENCHY Compare

Google: Gemma 4 26B A4B vs MoonshotAI: Kimi K2.5

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-05-01

Métrica	Gemma 4 26B A4B Gemma 4 26B A4B none Lançamento: 2026-04-03 Disponível grátis	Kimi K2.5 Kimi K2.5 medium Lançamento: 2026-01-27

Métrica	Gemma 4 26B A4B Gemma 4 26B A4B none Lançamento: 2026-04-03 Disponível grátis	Kimi K2.5 Kimi K2.5 medium Lançamento: 2026-01-27
Pontuação	6.4	7.0
Posição	#75	#60
Confiabilidade	N/D	N/D
Consistência	9.1	6.8
Testes corretos
Taxa de acerto por tentativa	51.9%	72.2%
Testes instáveis	2	7
Execuções totais	54	54
Custo por resultado	0.062	2.444
Custo total	$0.005	$0.220
Preço de entrada	$0.060 / 1M	$0.440 / 1M
Preço de saída	$0.330 / 1M	$2.000 / 1M
Tokens de saída	1,783	42,176
Tokens de raciocínio	0	84,870
Tempo de resposta (médio)	6.59s	72.43s
Tempo de resposta (máx.)	57.10s	150.77s
Tempo de resposta (total)	118.61s	796.70s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemma 4 26B A4B	8.3	10.0	75.0%	0		1.28s	230	0
Kimi K2.5	7.3	5.8	83.3%	2		51.38s	2,789	8,880

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemma 4 26B A4B	4.7	1.6	66.7%	1		7.07s	448	0
Kimi K2.5	4.7	1.6	66.7%	1		150.77s	1,269	9,749

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemma 4 26B A4B	3.0	10.0	0.0%	0		30.53s	309	0
Kimi K2.5	10.0	10.0	100.0%	0		71.37s	703	3,713

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemma 4 26B A4B	10.0	10.0	100.0%	0		1.70s	285	0
Kimi K2.5	10.0	10.0	100.0%	0		49.78s	563	7,940

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemma 4 26B A4B	3.6	7.2	22.2%	1		2.49s	27	0
Kimi K2.5	3.5	4.4	33.3%	2		137.29s	20,753	30,564

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemma 4 26B A4B	4.0	10.0	0.0%	0		3.54s	85	0
Kimi K2.5	6.5	3.4	66.7%	1		69.73s	3,815	4,262

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemma 4 26B A4B	6.3	10.0	50.0%	0		1.08s	75	0
Kimi K2.5	10.0	10.0	100.0%	0		92.47s	5,371	6,547

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemma 4 26B A4B	5.7	10.0	33.3%	0		739ms	114	0
Kimi K2.5	5.3	7.3	44.4%	1		45.40s	6,671	12,403

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemma 4 26B A4B	10.0	10.0	100.0%	0		57.10s	210	0
Kimi K2.5	10.0	10.0	100.0%	0		31.74s	242	812

Comparação rápida

Trocar par de comparação

Gemma 4 26B A4BnoneDisponível grátisvsGPT-5 Nanomedium DeepSeek V4 ProhighvsKimi K2.5medium Gemma 4 26B A4BnoneDisponível grátisvsLaguna M.1mediumDisponível grátis Gemma 4 31BnoneDisponível grátisvsKimi K2.5medium Gemma 4 26B A4BnoneDisponível grátisvsMercury 2medium Gemma 4 26B A4BnoneDisponível grátisvsLaguna Xs.2mediumDisponível grátis Kimi K2.5mediumvsQwen3.5 Plus 2026-02-15none Kimi K2.5mediumvsGPT-5.5none Gemma 4 26B A4BnoneDisponível grátisvsNemotron 3 SupermediumDisponível grátis Gemma 4 26B A4BnoneDisponível grátisvsGrok 4.1 Fastmedium Kimi K2.5mediumvsGLM 5none Claude Sonnet 4.6nonevsKimi K2.5medium