Navegação
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.2 Chat vs OpenAI: GPT-5.3-Codex

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-03-15

Métrica GPT-5.2 Chat GPT-5.2 Chat none Lançamento: 2025-12-11 GPT-5.3-Codex GPT-5.3-Codex medium Lançamento: 2026-02-05
Posição #17 #5
Pontuação 8.0 8.7
Consistência 9.1 9.1
Custo por resultado 2.440 4.485
Custo total $0.269 $0.539
Testes corretos
Taxa de acerto por tentativa 75.0% 83.3%
Testes instáveis 2 2
Execuções totais 48 48
Tokens de saída 15,845 1,764
Tokens de raciocínio 0 33,348
Tempo de resposta (médio) 7.03s 16.59s
Tempo de resposta (máx.) 38.52s 100.93s
Tempo de resposta (total) 112.51s 265.39s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-5.2 Chat 10.0 10.0 100.0% 0 3.97s 1,651 0
GPT-5.3-Codex 10.0 10.0 100.0% 0 4.69s 216 1,421
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-5.2 Chat 10.0 10.0 100.0% 0 9.12s 1,243 0
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.56s 364 2,731
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-5.2 Chat 10.0 10.0 100.0% 0 3.05s 980 0
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.07s 234 728
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-5.2 Chat 5.3 10.0 33.3% 0 17.78s 7,810 0
GPT-5.3-Codex 5.9 7.2 55.6% 1 64.31s 64 25,308
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-5.2 Chat 4.4 3.0 33.3% 1 3.20s 335 0
GPT-5.3-Codex 4.6 10.0 0.0% 0 4.87s 187 331
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-5.2 Chat 7.5 6.1 83.3% 1 5.46s 1,528 0
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.04s 93 693
Puzzle Solving Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-5.2 Chat 7.7 10.0 66.7% 0 4.42s 1,743 0
GPT-5.3-Codex 9.0 7.9 88.9% 1 5.12s 352 1,644
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
GPT-5.2 Chat 10.0 10.0 100.0% 0 4.68s 555 0
GPT-5.3-Codex 10.0 10.0 100.0% 0 6.37s 254 492

Comparação rápida

Trocar par de comparação