Navegação
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.7 Max vs Z.ai: GLM 5

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-05-22

Métrica Qwen3.7 Max Qwen3.7 Max none Lançamento: 2026-05-22 GLM 5 GLM 5 medium Lançamento: 2026-02-12
Pontuação 7.9 8.2
Posição #26 #18
Confiabilidade 10.0 10.0
Consistência 10.0 8.4
Testes corretos
Taxa de acerto por tentativa 70.0% 81.7%
Testes instáveis 0 4
Execuções totais 60 60
Custo por resultado 0.719 1.688
Custo total $0.101 $0.237
Preço de entrada $2.500 / 1M $0.600 / 1M
Preço de saída $7.500 / 1M $1.920 / 1M
Tokens de saída 1,988 23,219
Tokens de raciocínio 0 96,679
Tempo de resposta (médio) 1.30s 33.39s
Tempo de resposta (máx.) 3.92s 99.85s
Tempo de resposta (total) 25.95s 400.62s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.7 Max 6.5 10.0 50.0% 0 1.08s 242 0
GLM 5 10.0 10.0 100.0% 0 23.66s 480 7,056
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.7 Max 6.8 10.0 50.0% 0 1.39s 576 0
GLM 5 10.0 10.0 100.0% 0 89.47s 2,985 45,706
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.7 Max 3.0 10.0 0.0% 0 2.17s 171 0
GLM 5 10.0 10.0 100.0% 0 28.96s 662 3,242
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.7 Max 10.0 10.0 100.0% 0 1.35s 243 0
GLM 5 7.1 5.6 83.3% 1 8.90s 567 3,734
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.7 Max 7.7 10.0 66.7% 0 975ms 15 0
GLM 5 3.5 4.4 33.3% 2 0ms 13,176 14,137
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.7 Max 10.0 10.0 100.0% 0 1.04s 120 0
GLM 5 6.1 3.1 66.7% 1 14.69s 2,020 2,248
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.7 Max 10.0 10.0 100.0% 0 943ms 72 0
GLM 5 10.0 10.0 100.0% 0 7.25s 1,001 2,129
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.7 Max 10.0 10.0 100.0% 0 1.13s 314 0
GLM 5 10.0 10.0 100.0% 0 15.64s 1,694 4,983
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.7 Max 10.0 10.0 100.0% 0 3.92s 222 0
GLM 5 10.0 10.0 100.0% 0 15.93s 233 994
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.7 Max 3.0 10.0 0.0% 0 856ms 13 0
GLM 5 3.0 10.0 0.0% 0 67.37s 401 12,450

Comparação rápida

Trocar par de comparação