Navegação
AI BENCHY
Your ad here

AI BENCHY Compare

Mistral: Mistral Small 4 vs Hunter Alpha

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-03-17

Métrica Mistral Small 4 Mistral Small 4 medium Lançamento: 2026-03-16 Hunter Alpha Hunter Alpha none Lançamento: Data de lançamento desconhecida
Posição #55 #51
Pontuação 5.6 5.9
Consistência 7.0 8.1
Custo por resultado 0.502 0.000
Custo total $0.026 $0.000
Testes corretos
Taxa de acerto por tentativa 49.0% 49.0%
Testes instáveis 6 4
Execuções totais 51 51
Tokens de saída 12,288 2,278
Tokens de raciocínio 28,112 0
Tempo de resposta (médio) 4.18s 4.58s
Tempo de resposta (máx.) 25.25s 15.17s
Tempo de resposta (total) 71.03s 77.92s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 4,055 4,778
Hunter Alpha 3.5 8.0 16.7% 1 3.81s 779 0
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 2,612 10,700
Hunter Alpha 3.0 10.0 0.0% 0 15.17s 379 0
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 335 723
Hunter Alpha 10.0 10.0 100.0% 0 8.49s 249 0
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 2,621 6,904
Hunter Alpha 5.3 10.0 33.3% 0 2.33s 27 0
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 821 828
Hunter Alpha 6.1 3.1 66.7% 1 2.71s 91 0
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 540 1,031
Hunter Alpha 6.4 10.0 50.0% 0 2.82s 69 0
Puzzle Solving Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mistral Small 4 3.4 9.7 0.0% 0 2.00s 983 2,338
Hunter Alpha 5.8 4.4 66.7% 2 3.06s 349 0
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 321 810
Hunter Alpha 10.0 10.0 100.0% 0 6.02s 335 0

Comparação rápida

Trocar par de comparação