AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs MiniMax: MiniMax M2.7

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-04-02

Métrica	Seed-2.0-Lite Seed-2.0-Lite none Lançamento: 2026-02-14	MiniMax M2.7 MiniMax M2.7 medium Lançamento: 2026-03-18

Métrica	Seed-2.0-Lite Seed-2.0-Lite none Lançamento: 2026-02-14	MiniMax M2.7 MiniMax M2.7 medium Lançamento: 2026-03-18
Pontuação	6.0	5.0
Posição	#57	#76
Consistência	7.6	5.3
Testes corretos
Taxa de acerto por tentativa	52.9%	49.0%
Testes instáveis	5	10
Execuções totais	51	51
Custo por resultado	0.215	2.398
Custo total	$0.016	$0.072
Preço de entrada	$0.250 / 1M	$0.300 / 1M
Preço de saída	$2.000 / 1M	$1.200 / 1M
Tokens de saída	2,749	4,517
Tokens de raciocínio	0	47,612
Tempo de resposta (médio)	2.40s	27.32s
Tempo de resposta (máx.)	6.70s	117.04s
Tempo de resposta (total)	40.85s	437.10s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	3.0	5.9	16.7%	2		2.43s	709	0
MiniMax M2.7	7.9	6.3	83.3%	2		40.32s	3,010	17,716

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	3.0	10.0	0.0%	0		6.59s	498	0
MiniMax M2.7	4.7	1.6	66.7%	1		41.03s	369	4,480

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.82s	246	0
MiniMax M2.7	6.3	5.8	66.7%	1		21.95s	187	5,882

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	3.6	7.2	22.2%	1		1.33s	17	0
MiniMax M2.7	3.0	10.0	0.0%	0		19.00s	8	2,796

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.45s	294	0
MiniMax M2.7	3.9	2.5	33.3%	1		38.70s	92	5,204

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.06s	73	0
MiniMax M2.7	3.7	1.8	50.0%	2		12.64s	213	2,457

Puzzle Solving	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	5.2	4.4	55.6%	2		2.46s	620	0
MiniMax M2.7	3.8	4.5	33.3%	2		25.62s	334	8,076

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.94s	292	0
MiniMax M2.7	4.7	1.6	66.7%	1		12.05s	304	1,001

Comparação rápida

Trocar par de comparação

Seed-2.0-Litenonevsgpt-oss-120bmediumDisponível grátis MiniMax M2.7mediumvsQwen3 Coder Nextnone MiniMax M2.7mediumvsGPT-4o-mininone Seed-2.0-LitenonevsMiniMax M2.5mediumDisponível grátis Mercury 2nonevsMiniMax M2.7medium MiniMax M2.7mediumvsGPT-5.4 Mininone MiniMax M2.7mediumvsNemotron 3 SupernoneDisponível grátis MiniMax M2.7mediumvsQwen3.5-9Bnone Seed-2.0-LitenonevsGrok 4.20 Multi Agent Betamedium MiniMax M2.7mediumvsMistral Small 4none Seed-2.0-LitenonevsGPT-5 Nanomedium Trinity Large PreviewnoneDisponível grátisvsMiniMax M2.7medium