Navegação
AI BENCHY
Advertise here

AI BENCHY Compare

Gemini 3 PRO Preview vs OpenAI: GPT-5.3-Codex

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-05-29

Métrica Gemini 3 PRO Preview Gemini 3 PRO Preview medium Lançamento: 2025-11-18 GPT-5.3-Codex GPT-5.3-Codex medium Lançamento: 2026-02-05
Pontuação 8.1 8.3
Posição #22 #17
Confiabilidade N/D 10.0
Consistência 10.0 8.4
Testes corretos
Taxa de acerto por tentativa 73.7% 81.7%
Testes instáveis 0 4
Execuções totais 60 60
Custo por resultado 1.406 4.887
Custo total $0.197 $0.685
Preço de entrada $0.000 / 1M $1.750 / 1M
Preço de saída $0.000 / 1M $14.000 / 1M
Tokens de saída 1,490 2,336
Tokens de raciocínio 10,102 42,565
Tempo de resposta (médio) 9.05s 15.95s
Tempo de resposta (máx.) 26.24s 100.93s
Tempo de resposta (total) 90.53s 319.08s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 14.99s 149 1,485
GPT-5.3-Codex 8.7 7.9 91.7% 1 4.16s 240 1,722
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3 PRO Preview 3.0 10.0 0.0% 0 0ms 0 0
GPT-5.3-Codex 10.0 10.0 100.0% 0 18.45s 514 7,266
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3 PRO Preview 3.0 10.0 0.0% 0 10.37s 351 952
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.56s 364 2,731
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 10.84s 279 3,156
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.07s 234 728
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3 PRO Preview 5.3 10.0 33.3% 0 7.01s 15 1,195
GPT-5.3-Codex 5.9 7.2 55.6% 1 64.31s 64 25,308
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 9.34s 78 374
GPT-5.3-Codex 4.6 10.0 0.0% 0 4.87s 187 331
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3 PRO Preview 9.8 10.0 100.0% 0 3.26s 69 754
GPT-5.3-Codex 10.0 10.0 100.0% 0 3.04s 93 693
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 3.88s 225 1,215
GPT-5.3-Codex 9.0 7.9 88.9% 1 5.05s 356 1,593
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3 PRO Preview 10.0 10.0 100.0% 0 11.96s 324 971
GPT-5.3-Codex 10.0 10.0 100.0% 0 6.37s 254 492
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3 PRO Preview 0.0 0.0 0.0% 0 0ms 0 0
GPT-5.3-Codex 2.8 1.6 33.3% 1 14.43s 30 1,701

Comparação rápida

Trocar par de comparação