AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs OpenAI: GPT-5.3 Chat

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-01

Métrica	Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview medium Lançamento: 2026-03-03	GPT-5.3 Chat GPT-5.3 Chat none Lançamento: 2026-03-03

Métrica	Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview medium Lançamento: 2026-03-03	GPT-5.3 Chat GPT-5.3 Chat none Lançamento: 2026-03-03
Pontuação	7.7	7.4
Posição	#38	#57
Confiabilidade	10.0	10.0
Consistência	10.0	8.4
Testes corretos
Taxa de acerto por tentativa	65.0%	68.3%
Testes instáveis	0	4
Execuções totais	60	60
Custo por resultado	0.481	3.350
Custo total	$0.063	$0.402
Preço de entrada	$0.250 / 1M	$1.750 / 1M
Preço de saída	$1.500 / 1M	$14.000 / 1M
Tokens de saída	2,204	24,757
Tokens de raciocínio	33,657	0
Tempo de resposta (médio)	3.94s	6.13s
Tempo de resposta (máx.)	14.93s	18.33s
Tempo de resposta (total)	78.74s	122.61s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Flash Lite Preview	9.1	10.0	75.0%	0		2.33s	570	4,305
GPT-5.3 Chat	6.7	8.1	58.3%	1		3.86s	3,167	0

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Flash Lite Preview	6.8	10.0	50.0%	0		3.98s	455	5,510
GPT-5.3 Chat	6.9	6.2	66.7%	1		10.52s	4,772	0

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Flash Lite Preview	10.0	10.0	100.0%	0		14.93s	327	7,347
GPT-5.3 Chat	10.0	10.0	100.0%	0		11.96s	2,614	0

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Flash Lite Preview	10.0	10.0	100.0%	0		2.29s	279	2,952
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.21s	942	0

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Flash Lite Preview	3.0	10.0	0.0%	0		4.21s	18	5,325
GPT-5.3 Chat	3.5	4.4	33.3%	2		13.01s	8,264	0

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Flash Lite Preview	10.0	10.0	100.0%	0		3.16s	96	1,488
GPT-5.3 Chat	4.6	10.0	0.0%	0		1.99s	319	0

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Flash Lite Preview	10.0	10.0	100.0%	0		1.91s	72	2,121
GPT-5.3 Chat	9.8	10.0	100.0%	0		3.51s	1,491	0

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Flash Lite Preview	7.7	10.0	66.7%	0		5.30s	141	1,896
GPT-5.3 Chat	10.0	10.0	100.0%	0		2.99s	1,758	0

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Flash Lite Preview	10.0	10.0	100.0%	0		3.80s	234	912
GPT-5.3 Chat	10.0	10.0	100.0%	0		8.36s	861	0

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.1 Flash Lite Preview	3.0	10.0	0.0%	0		2.68s	12	1,801
GPT-5.3 Chat	3.0	10.0	0.0%	0		4.38s	569	0

Comparação rápida

Trocar par de comparação

GPT-5.3 ChatnonevsMiMo-V2.5medium GPT-5.3 ChatnonevsGLM 5.1medium Gemini 3.1 Flash LitelowvsGPT-5.3 Chatnone GPT-5.3 ChatnonevsStep 3.7 Flashlow Kimi K2.6mediumDisponível grátisvsGPT-5.3 Chatnone GPT-5.3 ChatnonevsStep 3.5 Flashmedium GPT-5.3 ChatnonevsGLM 5V Turbomedium DeepSeek V4 FlashhighvsGemini 3.1 Flash Lite Previewmedium MiniMax M3mediumvsGPT-5.3 Chatnone Gemini 3.1 Flash Lite PreviewmediumvsGPT-5.2 Chatnone GPT-5.3 ChatnonevsQwen3.5-35B-A3Bmedium Claude Sonnet 4.6mediumvsGPT-5.3 Chatnone