Navegação
Advertise here

Nemotron 3 Super vs Qwen3.5-9B (medium)

Nemotron 3 Super lidera na pontuação média com 4.5 vs 4.0. Nemotron 3 Super tem menor custo de benchmark com $0.016 vs $0.106. Nemotron 3 Super é mais rápido com 7.11s vs 110.18s, com taxas de acerto de 27.5% vs 26.1%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-10-07

Modelos comparados

Posição
#347
Total de tokens de saída
9,074
Tempo de resposta (médio)
7.11s
Custo total
$0.016
Posição
#360
Total de tokens de saída
447,247
Tempo de resposta (médio)
110.18s
Custo total
$0.106
Modelo recomendado Nemotron 3 Super

Tem a melhor pontuação aqui (4.5) e custa cerca de 6.7x menos que Qwen3.5-9B (medium).

Comparação detalhada

Métrica Nemotron 3 Super Nemotron 3 Super none Lançamento: 2026-03-11 Disponível grátis Qwen3.5-9B Qwen3.5-9B medium Lançamento: 2026-03-02
Pontuação 4.5 4.0
Posição #347 #360
Confiabilidade 9.5 8.7
Consistência 8.9 7.9
Tentativas 69/69 69/69
Testes corretos
Taxa de acerto por tentativa 27.5% 26.1%
Testes instáveis 3 6
Execuções totais 69 69
Custo por resultado 0.034 3.523
Custo total $0.016 $0.106
Preço de entrada $0.080 / 1M $0.100 / 1M
Preço de saída $0.450 / 1M $0.150 / 1M
Preço de leitura do cache N/D N/D
Preço de escrita no cache N/D N/D
Total de tokens de entrada 146,361 387,323
Tokens de saída 9,073 48,562
Tokens de raciocínio 1 410,431
Tempo de resposta (médio) 7.11s 110.18s
Tempo de resposta (máx.) 30.51s 569.97s
Tempo de resposta (total) 163.46s 1873.00s
Parâmetros 120B no total (12B ativos) 9B
Disponibilidade Pesos disponíveis Código aberto

Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#347 Nemotron 3 Super

none
Custo
$0.000
Tempo
137.8s
Tokens
2,447 tok

#360 Qwen3.5-9B

medium
Custo
$0.001
Tempo
35.9s
Tokens
3,030 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
Nemotron 3 Super 3.3 7.2 11.1% 1 2.64s 7,627 571 0
Qwen3.5-9B 2.9 10.0 0.0% 0 100.88s 2,396 7,890 41,129

Comparação rápida

Trocar par de comparação