Navegação
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs MiniMax: MiniMax M2.7

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-04-02

Métrica Seed-2.0-Lite Seed-2.0-Lite none Lançamento: 2026-02-14 MiniMax M2.7 MiniMax M2.7 medium Lançamento: 2026-03-18
Pontuação 6.0 5.0
Posição #57 #76
Consistência 7.6 5.3
Testes corretos
Taxa de acerto por tentativa 52.9% 49.0%
Testes instáveis 5 10
Execuções totais 51 51
Custo por resultado 0.215 2.398
Custo total $0.016 $0.072
Preço de entrada $0.250 / 1M $0.300 / 1M
Preço de saída $2.000 / 1M $1.200 / 1M
Tokens de saída 2,749 4,517
Tokens de raciocínio 0 47,612
Tempo de resposta (médio) 2.40s 27.32s
Tempo de resposta (máx.) 6.70s 117.04s
Tempo de resposta (total) 40.85s 437.10s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Seed-2.0-Lite 3.0 5.9 16.7% 2 2.43s 709 0
MiniMax M2.7 7.9 6.3 83.3% 2 40.32s 3,010 17,716
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Seed-2.0-Lite 3.0 10.0 0.0% 0 6.59s 498 0
MiniMax M2.7 4.7 1.6 66.7% 1 41.03s 369 4,480
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.82s 246 0
MiniMax M2.7 6.3 5.8 66.7% 1 21.95s 187 5,882
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Seed-2.0-Lite 3.6 7.2 22.2% 1 1.33s 17 0
MiniMax M2.7 3.0 10.0 0.0% 0 19.00s 8 2,796
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.45s 294 0
MiniMax M2.7 3.9 2.5 33.3% 1 38.70s 92 5,204
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Seed-2.0-Lite 10.0 10.0 100.0% 0 1.06s 73 0
MiniMax M2.7 3.7 1.8 50.0% 2 12.64s 213 2,457
Puzzle Solving Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Seed-2.0-Lite 5.2 4.4 55.6% 2 2.46s 620 0
MiniMax M2.7 3.8 4.5 33.3% 2 25.62s 334 8,076
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Seed-2.0-Lite 10.0 10.0 100.0% 0 3.94s 292 0
MiniMax M2.7 4.7 1.6 66.7% 1 12.05s 304 1,001

Comparação rápida

Trocar par de comparação