Navegação
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-9B vs Z.ai: GLM 5 Turbo

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-03-15

Métrica Qwen3.5-9B Qwen3.5-9B medium Lançamento: 2026-03-02 GLM 5 Turbo GLM 5 Turbo none Lançamento: 2026-03-15
Posição #65 #53
Pontuação 4.6 5.7
Consistência 7.4 9.5
Custo por resultado 0.779 0.467
Custo total $0.024 $0.028
Testes corretos
Taxa de acerto por tentativa 35.4% 39.6%
Testes instáveis 5 1
Execuções totais 48 48
Tokens de saída 17,930 1,264
Tokens de raciocínio 139,706 0
Tempo de resposta (médio) 71.44s 2.92s
Tempo de resposta (máx.) 226.38s 8.21s
Tempo de resposta (total) 928.77s 46.72s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.5-9B 5.9 7.2 55.6% 1 31.54s 2,410 10,913
GLM 5 Turbo 3.0 10.0 0.0% 0 3.01s 376 0
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.5-9B 3.0 10.0 0.0% 0 0ms 0 0
GLM 5 Turbo 3.0 10.0 0.0% 0 4.89s 144 0
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.5-9B 3.6 5.6 33.3% 1 87.31s 1,383 32,113
GLM 5 Turbo 10.0 10.0 100.0% 0 2.47s 204 0
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.5-9B 3.6 7.2 22.2% 1 137.75s 11,549 48,475
GLM 5 Turbo 5.3 10.0 33.3% 0 1.97s 25 0
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.5-9B 2.8 1.6 33.3% 1 226.38s 0 30,695
GLM 5 Turbo 4.2 9.9 0.0% 0 2.18s 48 0
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.5-9B 6.4 5.8 66.7% 1 17.15s 599 4,517
GLM 5 Turbo 6.5 10.0 50.0% 0 2.13s 65 0
Puzzle Solving Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.5-9B 3.1 10.0 0.0% 0 33.38s 1,545 11,844
GLM 5 Turbo 5.5 7.4 44.4% 1 2.43s 180 0
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Qwen3.5-9B 10.0 10.0 100.0% 0 4.31s 444 1,149
GLM 5 Turbo 10.0 10.0 100.0% 0 8.21s 222 0

Comparação rápida

Trocar par de comparação