Navegação
Advertise here

Modelos comparados

Comparação benchmark MiniMax M2.7 (medium) vs Kimi K2.5 (medium) vs GLM 5 (medium) vs Gemini 3.1 Flash Lite Preview (medium): GLM 5 (medium) lidera em Pontuação com 7.2. MiniMax M2.7 (medium) lidera em Confiabilidade com 10.0. Gemini 3.1 Flash Lite Preview (medium) tem o menor Custo total em $0.158. Gemini 3.1 Flash Lite Preview (medium) é o mais rápido com 6.78s.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-10-01

Modelos comparados

Posição
#298
Total de tokens de saída
174,351
Tempo de resposta (médio)
50.32s
Custo total
$0.202
Posição
#205
Total de tokens de saída
241,096
Tempo de resposta (médio)
125.76s
Custo total
$0.603
Posição
#146
Total de tokens de saída
138,257
Tempo de resposta (médio)
39.05s
Custo total
$0.360
Posição
#155
Total de tokens de saída
59,534
Tempo de resposta (médio)
6.78s
Custo total
$0.158
Modelo recomendado Gemini 3.1 Flash Lite Preview (medium)

A pontuação fica perto da melhor aqui (7.0 vs 7.2) e custa cerca de 2.5x menos que os outros modelos nesta comparação.

Comparação detalhada

Métrica MiniMax M2.7 MiniMax M2.7 medium Lançamento: 2026-03-18 Kimi K2.5 Kimi K2.5 medium Lançamento: 2026-01-27 GLM 5 GLM 5 medium Lançamento: 2026-02-12 Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview medium Lançamento: 2026-03-03
Pontuação 5.0 6.4 7.2 7.0
Posição #298 #205 #146 #155
Confiabilidade 10.0 9.6 10.0 10.0
Consistência 6.4 7.1 7.9 9.9
Tentativas 69/69 69/69 66/69 69/69
Testes corretos
Taxa de acerto por tentativa 44.9% 60.9% 76.8% 60.9%
Testes instáveis 10 8 5 0
Execuções totais 69 69 66 69
Custo por resultado 5.279 6.085 2.552 1.124
Custo total $0.202 $0.603 $0.360 $0.158
Preço de entrada $0.210 / 1M $0.450 / 1M $0.600 / 1M $0.250 / 1M
Preço de saída $0.840 / 1M $2.250 / 1M $1.920 / 1M $1.500 / 1M
Total de tokens de entrada 277,130 292,271 212,440 272,221
Tokens de saída 45,188 55,025 22,922 12,345
Tokens de raciocínio 129,163 186,071 115,335 47,189
Tempo de resposta (médio) 50.32s 125.76s 39.05s 6.78s
Tempo de resposta (máx.) 198.82s 566.79s 110.70s 54.91s
Tempo de resposta (total) 1107.03s 2137.84s 546.68s 155.96s
Parâmetros 230B no total (10B ativos) 1T no total (32B ativos) 744B no total (40B ativos) ~150B no total (~10B ativos)
Disponibilidade Pesos disponíveis Pesos disponíveis Código aberto Código fechado

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#298 MiniMax M2.7

medium
Custo
$0.022
Tempo
22.8s
Tokens
9,250 tok

#205 MoonshotAI: Kimi K2.5

medium
Custo
$0.030
Tempo
58.6s
Tokens
8,683 tok

#146 GLM 5

medium
Custo
$0.005
Tempo
20.7s
Tokens
2,068 tok

#155 Gemini 3.1 Flash Lite Preview

medium
Custo
$0.003
Tempo
5.2s
Tokens
1,944 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
MiniMax M2.7 5.7 9.1 33.3% 0 101.89s 2,961 1,231 38,841
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 4.09s 8,126 461 8,597

Comparação rápida

Trocar par de comparação