Navegação
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs OpenAI: GPT-5.4 Nano

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-05-19

Métrica Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite low Lançamento: 2026-05-08 GPT-5.4 Nano GPT-5.4 Nano medium Lançamento: 2026-03-17
Pontuação 7.6 7.3
Posição #49 #58
Confiabilidade 10.0 10.0
Consistência 9.2 9.1
Testes corretos
Taxa de acerto por tentativa 68.4% 64.9%
Testes instáveis 2 2
Execuções totais 57 57
Custo por resultado 0.203 0.761
Custo total $0.025 $0.084
Preço de entrada $0.250 / 1M $0.200 / 1M
Preço de saída $1.500 / 1M $1.250 / 1M
Tokens de saída 2,702 3,016
Tokens de raciocínio 8,596 59,306
Tempo de resposta (médio) 1.92s 10.87s
Tempo de resposta (máx.) 5.66s 94.06s
Tempo de resposta (total) 36.49s 206.61s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 7.3 6.2 75.0% 2 1.84s 1,013 1,548
GPT-5.4 Nano 8.3 10.0 75.0% 0 4.52s 683 2,254
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.46s 441 408
GPT-5.4 Nano 10.0 10.0 100.0% 0 13.41s 472 3,616
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 4.48s 348 975
GPT-5.4 Nano 9.8 10.0 100.0% 0 24.13s 349 5,719
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.44s 291 697
GPT-5.4 Nano 10.0 10.0 100.0% 0 2.54s 234 516
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 5.3 10.0 33.3% 0 1.52s 15 1,214
GPT-5.4 Nano 5.9 7.2 55.6% 1 38.18s 60 43,325
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 1.37s 69 438
GPT-5.4 Nano 4.5 10.0 0.0% 0 4.15s 179 443
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.52s 72 760
GPT-5.4 Nano 9.8 10.0 100.0% 0 1.88s 95 521
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.40s 210 1,191
GPT-5.4 Nano 3.7 7.1 22.2% 1 3.65s 640 1,356
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 5.66s 234 945
GPT-5.4 Nano 10.0 10.0 100.0% 0 7.71s 234 382
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de saída Tokens de raciocínio
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 1.46s 9 420
GPT-5.4 Nano 3.0 10.0 0.0% 0 4.81s 70 1,174

Comparação rápida

Trocar par de comparação