Navegação
Advertise here

DeepSeek V3.2 (medium) vs Ling 3.1 Flash (low)

A pontuação média está praticamente empatada em 6.3 vs 6.3. Ling 3.1 Flash (low) tem menor custo de benchmark com $0.000 vs $0.152. DeepSeek V3.2 (medium) é mais rápido com 70.08s vs 85.22s, com taxas de acerto de 62.3% vs 66.7%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-10-03

Modelos comparados

Posição
#225
Total de tokens de saída
143,160
Tempo de resposta (médio)
70.08s
Custo total
$0.152
Posição
#222
Total de tokens de saída
704,170
Tempo de resposta (médio)
85.22s
Custo total
$0.000
Modelo recomendado DeepSeek V3.2 (medium)

Tem a pontuação mais forte nesta comparação (6.3) e o melhor equilíbrio geral entre custo e tempo de resposta entre os 2 modelos.

Comparação detalhada

Métrica DeepSeek V3.2 DeepSeek V3.2 medium Lançamento: 2025-12-01 Ling 3.1 Flash Ling 3.1 Flash low Lançamento: 2026-10-03
Pontuação 6.3 6.3
Posição #225 #222
Confiabilidade 10.0 9.7
Consistência 7.5 7.8
Tentativas 69/69 69/69
Testes corretos
Taxa de acerto por tentativa 62.3% 66.7%
Testes instáveis 7 6
Execuções totais 69 69
Custo por resultado 1.250 0.000
Custo total $0.152 $0.000
Preço de entrada $0.280 / 1M $0.000 / 1M
Preço de saída $0.420 / 1M $0.000 / 1M
Preço de leitura do cache $0.028 / 1M N/D
Preço de escrita no cache N/D N/D
Total de tokens de entrada 306,662 271,890
Tokens de saída 17,819 190,841
Tokens de raciocínio 125,341 513,329
Tempo de resposta (médio) 70.08s 85.22s
Tempo de resposta (máx.) 376.10s 432.81s
Tempo de resposta (total) 1611.86s 1960.12s
Parâmetros 671B no total (37B ativos) 560B no total (25B ativos)
Disponibilidade Código aberto Código fechado

Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#225 DeepSeek V3.2

medium
Custo
$0.001
Tempo
53.6s
Tokens
1,932 tok

#222 Ling 3.1 Flash

low
Custo
$0.000
Tempo
133.5s
Tokens
12,950 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
Ling 3.1 Flash 5.6 4.2 66.7% 2 107.30s 8,298 20,816 86,330

Comparação rápida

Trocar par de comparação