DeepSeek V4 Flash (high) vs GPT-5.3-Codex (medium)

Modelo recomendado GPT-5.3-Codex (medium)

Tem a melhor pontuação aqui (8.9) e responde cerca de 2.9x mais rápido que DeepSeek V4 Flash (high).

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-07-25

Resumo da comparação

Métrica	DeepSeek V4 Flash DeepSeek V4 Flash high Lançamento: 2026-04-24	GPT-5.3-Codex GPT-5.3-Codex medium Lançamento: 2026-02-05

Métrica	DeepSeek V4 Flash DeepSeek V4 Flash high Lançamento: 2026-04-24	GPT-5.3-Codex GPT-5.3-Codex medium Lançamento: 2026-02-05
Pontuação	7.7	8.9
Posição	#52	#18
Confiabilidade	10.0	10.0
Consistência	8.2	8.6
Testes corretos
Taxa de acerto por tentativa	72.7%	83.3%
Testes instáveis	5	4
Execuções totais	66	66
Custo por resultado	0.402	5.748
Custo total	$0.041	$0.920
Preço de entrada	$0.094 / 1M	$1.750 / 1M
Preço de saída	$0.188 / 1M	$14.000 / 1M
Total de tokens de entrada	108,392	81,268
Tokens de saída	14,478	6,251
Tokens de raciocínio	153,687	49,274
Tempo de resposta (médio)	49.75s	16.96s
Tempo de resposta (máx.)	218.13s	100.93s
Tempo de resposta (total)	1094.41s	373.19s

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

high

medium

Categoria:

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Flash	8.3	10.0	75.0%	0		28.51s	540	140	7,770
GPT-5.3-Codex	8.7	7.9	91.7%	1		4.16s	606	240	1,722

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Flash	7.8	10.0	66.7%	0		50.60s	7,279	395	34,862
GPT-5.3-Codex	10.0	10.0	100.0%	0		19.50s	7,302	535	10,890

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Flash	6.4	5.8	66.7%	1		104.10s	82,663	4,633	37,533
GPT-5.3-Codex	10.0	10.0	100.0%	0		26.04s	57,988	4,258	5,816

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Flash	10.0	10.0	100.0%	0		28.03s	7,290	201	1,179
GPT-5.3-Codex	10.0	10.0	100.0%	0		3.07s	7,140	234	728

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Flash	4.1	4.4	44.5%	2		100.31s	666	27	59,249
GPT-5.3-Codex	5.9	7.2	55.6%	1		64.31s	813	64	25,308

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Flash	6.1	3.1	66.7%	1		25.15s	471	79	632
GPT-5.3-Codex	4.6	10.0	0.0%	0		4.87s	477	187	331

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Flash	10.0	10.0	100.0%	0		15.36s	627	63	1,622
GPT-5.3-Codex	10.0	10.0	100.0%	0		3.04s	660	93	693

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Flash	8.2	7.2	88.9%	1		26.11s	594	196	1,767
GPT-5.3-Codex	9.0	7.9	88.9%	1		5.05s	642	356	1,593

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Flash	10.0	10.0	100.0%	0		74.73s	8,079	228	542
GPT-5.3-Codex	10.0	10.0	100.0%	0		6.37s	5,445	254	492

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Flash	3.0	10.0	0.0%	0		54.46s	183	8,516	8,531
GPT-5.3-Codex	2.8	1.6	33.3%	1		14.43s	195	30	1,701

Trocar par de comparação