Navegação
AI BENCHY
Comparar Gráficos
❤️ Made by XCS
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.4 vs Z.ai: GLM 4.7 Flash

Comparar:

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-03-05

Métrica OpenAI: GPT-5.4 none Lançamento: 2026-03-05 Z.ai: GLM 4.7 Flash medium Lançamento: 2026-01-19
Posição #44 #52
Pontuação média 4.6 3.3
Testes corretos
Consistência 8.9 6.1
Custo por resultado 1.496 1.018
Custo total $0.090 $0.041
Taxa de acerto por tentativa 44.4% 44.4%
Testes instáveis 2 7
common.totalAttempts 45 (15 x 3) 45 (15 x 3)
Tokens de saída 1,635 38,664
Tokens de raciocínio 0 62,814
Tempo de resposta (médio) 1.46s 39.18s
Tempo de resposta (máx.) 2.89s 174.55s
Tempo de resposta (total) 21.86s 313.44s

Melhores modelos por pontuação

Tempo de resposta (médio)

Pontuação vs custo total

Pontuação média vs Tempo de resposta (médio)

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
OpenAI: GPT-5.4 10.0 7.3 11.1% 1 1.41s 388 0
Z.ai: GLM 4.7 Flash 4.0 4.5 55.6% 2 27.09s 1,085 5,597
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
OpenAI: GPT-5.4 10.0 10.0 0.0% 0 2.89s 291 0
Z.ai: GLM 4.7 Flash 10.0 2.1 33.3% 1 65.57s 2,585 20,648
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
OpenAI: GPT-5.4 9.9 10.0 100.0% 0 1.04s 222 0
Z.ai: GLM 4.7 Flash 5.0 10.0 50.0% 0 1.51s 584 2,755
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
OpenAI: GPT-5.4 4.0 7.2 44.4% 1 1.07s 50 0
Z.ai: GLM 4.7 Flash 10.0 4.4 33.3% 2 174.55s 33,000 25,394
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
OpenAI: GPT-5.4 5.5 10.0 50.0% 0 1.07s 81 0
Z.ai: GLM 4.7 Flash 5.0 5.8 66.7% 1 2.97s 388 2,181
Puzzle Solving Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
OpenAI: GPT-5.4 4.0 9.8 33.3% 0 1.52s 357 0
Z.ai: GLM 4.7 Flash 10.0 7.2 11.1% 1 12.90s 798 5,225
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
OpenAI: GPT-5.4 10.0 10.0 100.0% 0 2.75s 246 0
Z.ai: GLM 4.7 Flash 10.0 10.0 100.0% 0 15.95s 224 1,014

Comparação rápida

Trocar par de comparação