Navegação
AI BENCHY
Your ad here

AI BENCHY Compare

Hunter Alpha vs xAI: Grok 4.20

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-04-02

Métrica Hunter Alpha Hunter Alpha medium Lançamento: 2026-03-11 Grok 4.20 Grok 4.20 none Lançamento: 2026-03-31
Pontuação 7.0 5.4
Posição #42 #69
Consistência 7.2 9.5
Testes corretos
Taxa de acerto por tentativa 68.6% 31.4%
Testes instáveis 6 1
Execuções totais 51 51
Custo por resultado 0.000 1.809
Custo total $0.000 $0.091
Preço de entrada $0.000 / 1M $2.000 / 1M
Preço de saída $0.000 / 1M $6.000 / 1M
Tokens de saída 4,724 1,655
Tokens de raciocínio 17,921 0
Tempo de resposta (médio) 10.33s 1.11s
Tempo de resposta (máx.) 30.53s 6.04s
Tempo de resposta (total) 175.60s 18.80s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Hunter Alpha 7.3 5.8 83.3% 2 4.75s 479 1,103
Grok 4.20 4.8 10.0 25.0% 0 501ms 267 0
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Hunter Alpha 4.7 1.6 66.7% 1 30.53s 792 3,456
Grok 4.20 3.0 10.0 0.0% 0 6.04s 282 0
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Hunter Alpha 10.0 10.0 100.0% 0 23.16s 1,488 8,017
Grok 4.20 10.0 10.0 100.0% 0 522ms 207 0
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Hunter Alpha 3.0 10.0 0.0% 0 10.52s 892 2,406
Grok 4.20 3.0 10.0 0.0% 0 687ms 325 0
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Hunter Alpha 7.0 3.7 66.7% 1 6.44s 116 260
Grok 4.20 4.8 10.0 0.0% 0 659ms 83 0
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Hunter Alpha 9.9 10.0 100.0% 0 4.18s 208 465
Grok 4.20 4.8 10.0 0.0% 0 455ms 60 0
Puzzle Solving Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Hunter Alpha 6.1 4.7 66.7% 2 5.36s 441 1,310
Grok 4.20 5.3 7.4 44.4% 1 487ms 242 0
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Hunter Alpha 10.0 10.0 100.0% 0 17.33s 308 904
Grok 4.20 10.0 10.0 100.0% 0 4.63s 189 0

Comparação rápida

Trocar par de comparação