AI BENCHY Compare

IBM: Granite 4.1 8B vs MiniMax: MiniMax M2.7

Resumo

Comparação benchmark Granite 4.1 8B vs MiniMax M2.7: MiniMax M2.7 lidera na pontuação média com 5.2 vs 4.0. Granite 4.1 8B tem menor custo de benchmark com $0.003 vs $0.104. Granite 4.1 8B é mais rápido com 728ms vs 38.18s, com taxas de acerto de 9.5% vs 46.0%.

Modelo recomendado: Granite 4.1 8B - Oferece o melhor compromisso geral: pontuação competitiva (4.0), custo menor que MiniMax M2.7 e tempo de resposta equilibrado.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-12

Métrica	Granite 4.1 8B Granite 4.1 8B none Lançamento: 2026-05-01	MiniMax M2.7 MiniMax M2.7 medium Lançamento: 2026-03-18

Métrica	Granite 4.1 8B Granite 4.1 8B none Lançamento: 2026-05-01	MiniMax M2.7 MiniMax M2.7 medium Lançamento: 2026-03-18
Pontuação	4.0	5.2
Posição	#163	#134
Confiabilidade	10.0	10.0
Consistência	10.0	6.8
Testes corretos
Taxa de acerto por tentativa	9.5%	46.0%
Testes instáveis	0	8
Execuções totais	63	63
Custo por resultado	0.131	2.494
Custo total	$0.003	$0.104
Preço de entrada	$0.050 / 1M	$0.250 / 1M
Preço de saída	$0.100 / 1M	$1.000 / 1M
Total de tokens de entrada	46,285	34,371
Tokens de saída	2,911	8,981
Tokens de raciocínio	0	89,812
Tempo de resposta (médio)	728ms	38.18s
Tempo de resposta (máx.)	2.17s	196.21s
Tempo de resposta (total)	15.29s	763.60s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#163 IBM: Granite 4.1 8B

none

Cost: $0.001
Time: 3.2s
Tokens: 491 tok

#134 MiniMax M2.7

medium

Cost: $0.022
Time: 22.8s
Tokens: 9,250 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Granite 4.1 8B	4.9	10.0	25.0%	0		844ms	645	903	0
MiniMax M2.7	7.9	6.3	83.3%	2		40.32s	654	3,010	17,716

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Granite 4.1 8B	4.5	10.0	0.0%	0		775ms	8,344	525	0
MiniMax M2.7	5.7	9.1	33.3%	0		101.89s	2,961	1,231	38,841

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Granite 4.1 8B	3.0	10.0	0.0%	0		1.88s	19,089	396	0
MiniMax M2.7	4.7	1.6	66.7%	1		41.03s	14,233	369	4,480

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Granite 4.1 8B	3.0	10.0	0.0%	0		575ms	7,617	195	0
MiniMax M2.7	6.3	5.8	66.7%	1		21.95s	7,152	187	5,882

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Granite 4.1 8B	3.0	10.0	0.0%	0		357ms	768	24	0
MiniMax M2.7	3.0	10.0	0.0%	0		19.00s	245	8	2,796

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Granite 4.1 8B	4.0	10.0	0.0%	0		499ms	528	115	0
MiniMax M2.7	3.9	2.5	33.3%	1		38.70s	486	92	5,204

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Granite 4.1 8B	3.6	9.9	0.0%	0		344ms	687	66	0
MiniMax M2.7	3.8	5.8	33.3%	1		12.80s	687	350	2,600

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Granite 4.1 8B	3.2	10.0	0.0%	0		608ms	672	432	0
MiniMax M2.7	5.9	7.2	55.6%	1		24.87s	675	362	7,840

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Granite 4.1 8B	10.0	10.0	100.0%	0		2.17s	7,719	243	0
MiniMax M2.7	4.7	1.6	66.7%	1		12.05s	7,067	304	1,001

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Granite 4.1 8B	3.0	10.0	0.0%	0		306ms	216	12	0
MiniMax M2.7	3.0	10.0	0.0%	0		22.77s	211	3,068	3,452

Comparação rápida

Trocar par de comparação

MiniMax M2.7mediumvsQwen3.6 35B A3Bnone MiniMax M2.7mediumvsMistral Small 4none MiniMax M2.7mediumvsQwen3 Coder Nextnone MiniMax M2.7mediumvsMiMo-V2.5none DeepSeek V3.2nonevsMiniMax M2.7medium MiniMax M2.7mediumvsQwen3.5-9Bnone MiniMax M2.7mediumvsQwen3.5-122B-A10Bnone MiniMax M2.7mediumvsGPT-5.4 Mininone MiniMax M2.7mediumvsGrok 4.20none MiniMax M2.7mediumvsGLM 5 Turbonone Trinity Large PreviewnonevsMiniMax M2.7medium Granite 4.1 8BnonevsQwen3.5-9Bmedium