Navegação
AI BENCHY
Your ad here

AI BENCHY Compare

MiniMax: MiniMax M2.7 vs MoonshotAI: Kimi K2.5

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-03-18

Métrica MiniMax M2.7 MiniMax M2.7 medium Lançamento: 2026-03-18 Kimi K2.5 Kimi K2.5 none Lançamento: 2026-01-27
Pontuação 5.0 5.3
Posição #64 #59
Consistência 5.3 8.7
Testes corretos
Taxa de acerto por tentativa 49.0% 37.3%
Testes instáveis 10 3
Execuções totais 51 51
Custo por resultado 2.398 0.297
Custo total $0.072 $0.015
Preço de entrada $0.300 / 1M $0.450 / 1M
Preço de saída $1.200 / 1M $2.200 / 1M
Tokens de saída 4,517 2,010
Tokens de raciocínio 47,612 0
Tempo de resposta (médio) 27.32s 10.83s
Tempo de resposta (máx.) 117.04s 42.13s
Tempo de resposta (total) 437.10s 108.27s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
MiniMax M2.7 7.9 6.3 83.3% 2 40.32s 3,010 17,716
Kimi K2.5 3.6 8.4 8.3% 1 6.24s 373 0
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
MiniMax M2.7 4.7 1.6 66.7% 1 41.03s 369 4,480
Kimi K2.5 2.8 2.1 33.3% 1 19.16s 748 0
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
MiniMax M2.7 6.3 5.8 66.7% 1 21.95s 187 5,882
Kimi K2.5 7.3 5.8 83.3% 1 42.13s 187 0
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
MiniMax M2.7 3.0 10.0 0.0% 0 19.00s 8 2,796
Kimi K2.5 5.3 10.0 33.3% 0 4.38s 29 0
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
MiniMax M2.7 3.9 2.5 33.3% 1 38.70s 92 5,204
Kimi K2.5 10.0 10.0 100.0% 0 4.00s 76 0
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
MiniMax M2.7 3.7 1.8 50.0% 2 12.64s 213 2,457
Kimi K2.5 6.5 10.0 50.0% 0 2.67s 60 0
Puzzle Solving Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
MiniMax M2.7 3.8 4.5 33.3% 2 25.62s 334 8,076
Kimi K2.5 3.1 10.0 0.0% 0 4.73s 317 0
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
MiniMax M2.7 4.7 1.6 66.7% 1 12.05s 304 1,001
Kimi K2.5 10.0 10.0 100.0% 0 13.99s 220 0

Comparação rápida

Trocar par de comparação