Navegação
AI BENCHY
Your ad here

AI BENCHY Compare

xAI: Grok 4.20 Beta vs Z.ai: GLM 5 Turbo

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-03-15

Métrica Grok 4.20 Beta Grok 4.20 Beta none Lançamento: 2026-03-12 GLM 5 Turbo GLM 5 Turbo none Lançamento: 2026-03-15
Posição #54 #53
Pontuação 5.5 5.7
Consistência 9.1 9.5
Custo por resultado 2.214 0.467
Custo total $0.089 $0.028
Testes corretos
Taxa de acerto por tentativa 33.3% 39.6%
Testes instáveis 2 1
Execuções totais 48 48
Tokens de saída 1,511 1,264
Tokens de raciocínio 0 0
Tempo de resposta (médio) 1.22s 2.92s
Tempo de resposta (máx.) 6.48s 8.21s
Tempo de resposta (total) 19.53s 46.72s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Grok 4.20 Beta 4.3 7.9 22.2% 1 562ms 245 0
GLM 5 Turbo 3.0 10.0 0.0% 0 3.01s 376 0
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Grok 4.20 Beta 3.0 10.0 0.0% 0 6.48s 282 0
GLM 5 Turbo 3.0 10.0 0.0% 0 4.89s 144 0
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Grok 4.20 Beta 10.0 10.0 100.0% 0 601ms 197 0
GLM 5 Turbo 10.0 10.0 100.0% 0 2.47s 204 0
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Grok 4.20 Beta 3.0 10.0 0.0% 0 611ms 160 0
GLM 5 Turbo 5.3 10.0 33.3% 0 1.97s 25 0
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Grok 4.20 Beta 5.0 10.0 0.0% 0 541ms 87 0
GLM 5 Turbo 4.2 9.9 0.0% 0 2.18s 48 0
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Grok 4.20 Beta 4.8 10.0 0.0% 0 687ms 60 0
GLM 5 Turbo 6.5 10.0 50.0% 0 2.13s 65 0
Puzzle Solving Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Grok 4.20 Beta 5.9 7.2 55.6% 1 541ms 291 0
GLM 5 Turbo 5.5 7.4 44.4% 1 2.43s 180 0
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.79s 189 0
GLM 5 Turbo 10.0 10.0 100.0% 0 8.21s 222 0

Comparação rápida

Trocar par de comparação