DeepSeek: DeepSeek V4 Pro vs NVIDIA: Nemotron 3 Ultra

DeepSeek V4 Pro (high) lidera na pontuação média com 7.7 vs 7.5. DeepSeek V4 Pro (high) tem menor custo de benchmark com $0.200 vs $0.774. Nemotron 3 Ultra (medium) é mais rápido com 32.21s vs 79.14s, com taxas de acerto de 63.6% vs 68.2%.

Modelo recomendadoDeepSeek V4 Pro (high)Tem a melhor pontuação aqui (7.7) e custa cerca de 3.9x menos que Nemotron 3 Ultra (medium).

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-07-22

Métrica	DeepSeek V4 Pro DeepSeek V4 Pro high Lançamento: 2026-04-24	Nemotron 3 Ultra Nemotron 3 Ultra medium Lançamento: 2026-06-04 Disponível grátis

Métrica	DeepSeek V4 Pro DeepSeek V4 Pro high Lançamento: 2026-04-24	Nemotron 3 Ultra Nemotron 3 Ultra medium Lançamento: 2026-06-04 Disponível grátis
Pontuação	7.7	7.5
Posição	#50	#55
Confiabilidade	10.0	9.8
Consistência	7.7	8.5
Testes corretos
Taxa de acerto por tentativa	63.6%	68.2%
Testes instáveis	6	4
Execuções totais	66	66
Custo por resultado	2.000	0.000
Custo total	$0.200	$0.774
Preço de entrada	$0.435 / 1M	$0.600 / 1M
Preço de saída	$0.870 / 1M	$3.600 / 1M
Total de tokens de entrada	90,748	233,488
Tokens de saída	10,462	57,916
Tokens de raciocínio	178,719	128,062
Tempo de resposta (médio)	79.14s	32.21s
Tempo de resposta (máx.)	416.76s	392.56s
Tempo de resposta (total)	1740.97s	708.65s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 DeepSeek V4 Pro

high

Custo: $0.023
Tempo: 257.6s
Tokens: 14,870 tok

#55 Nemotron 3 Ultra

medium

SVG inválido

Custo: $0.000
Tempo: 300.0s
Tokens: 0 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Categoria:

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Pro	5.7	5.9	58.3%	2		25.70s	536	149	3,214
Nemotron 3 Ultra	10.0	10.0	100.0%	0		8.62s	780	835	1,485

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Pro	6.3	8.7	33.3%	0		243.00s	5,090	383	84,580
Nemotron 3 Ultra	8.4	7.4	88.9%	1		26.53s	7,686	2,854	17,725

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Pro	10.0	10.0	100.0%	0		78.99s	66,082	4,582	25,404
Nemotron 3 Ultra	6.3	5.8	66.7%	1		218.25s	204,249	40,954	78,561

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Pro	10.0	10.0	100.0%	0		25.03s	7,690	274	2,166
Nemotron 3 Ultra	10.0	10.0	100.0%	0		5.68s	7,989	473	1,285

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Pro	3.6	7.2	22.2%	1		151.46s	569	4,404	50,391
Nemotron 3 Ultra	3.5	4.4	33.3%	2		24.90s	858	11,169	16,249

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Pro	10.0	10.0	100.0%	0		8.83s	471	115	1,013
Nemotron 3 Ultra	3.7	9.5	0.0%	0		2.52s	360	70	235

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Pro	7.8	6.6	83.3%	1		8.73s	627	66	2,726
Nemotron 3 Ultra	9.8	10.0	100.0%	0		6.35s	765	182	1,243

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Pro	6.9	4.9	77.8%	2		56.85s	591	178	2,563
Nemotron 3 Ultra	5.5	9.9	33.3%	0		3.54s	792	771	2,055

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Pro	9.8	10.0	100.0%	0		15.92s	8,909	295	701
Nemotron 3 Ultra	10.0	10.0	100.0%	0		7.72s	9,781	304	984

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
DeepSeek V4 Pro	3.0	10.0	0.0%	0		34.01s	183	16	5,961
Nemotron 3 Ultra	3.0	10.0	0.0%	0		38.47s	228	304	8,240

Comparação rápida

Trocar par de comparação

Nemotron 3 UltramediumDisponível grátisvsGPT-5.3 Chatnone Claude Opus 4.6mediumvsDeepSeek V4 Prohigh DeepSeek V4 ProhighvsMiniMax M3medium Nemotron 3 UltramediumDisponível grátisvsGPT-5.6 Terralow DeepSeek V4 ProhighvsGLM 5medium DeepSeek V4 ProhighvsGrok Build 0.1medium DeepSeek V4 ProhighvsGPT-5.6 Lunamedium Claude Opus 4.8lowvsDeepSeek V4 Prohigh Nemotron 3 UltramediumDisponível grátisvsQwen3.7 Maxnone DeepSeek V4 FlashhighvsNemotron 3 UltramediumDisponível grátis DeepSeek V4 ProhighvsKimi K2.7 Codemedium DeepSeek V4 ProhighvsGPT-5.4 Nanomedium