Navegação
Advertise here

DeepSeek V4.1 Flash (medium) vs Muse Spark 1.1 (low)

DeepSeek V4.1 Flash (medium) lidera na pontuação média com 8.7 vs 8.6. DeepSeek V4.1 Flash (medium) tem menor custo de benchmark com $0.591 vs $0.885. Muse Spark 1.1 (low) é mais rápido com 13.21s vs 32.88s, com taxas de acerto de 73.9% vs 72.5%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-10-07

Modelos comparados

Posição
#53
Total de tokens de saída
444,665
Tempo de resposta (médio)
32.88s
Custo total
$0.591
Posição
#61
Total de tokens de saída
122,421
Tempo de resposta (médio)
13.21s
Custo total
$0.885
Modelo recomendado Muse Spark 1.1 (low)

A pontuação fica perto da melhor aqui (8.6 vs 8.7) e responde cerca de 2.5x mais rápido que DeepSeek V4.1 Flash (medium).

Comparação detalhada

Métrica DeepSeek V4.1 Flash DeepSeek V4.1 Flash medium Lançamento: 2026-09-10 Muse Spark 1.1 Muse Spark 1.1 low Lançamento: 2026-07-16
Pontuação 8.7 8.6
Posição #53 #61
Confiabilidade 9.6 10.0
Consistência 9.3 8.6
Tentativas 69/69 69/69
Testes corretos
Taxa de acerto por tentativa 73.9% 72.5%
Testes instáveis 2 4
Execuções totais 69 69
Custo por resultado 1.757 6.318
Custo total $0.591 $0.885
Preço de entrada $0.013 / 1M $1.250 / 1M
Preço de saída $1.320 / 1M $4.250 / 1M
Preço de leitura do cache $0.013 / 1M $0.150 / 1M
Preço de escrita no cache N/D N/D
Total de tokens de entrada 280,643 291,368
Tokens de saída 7,342 13,469
Tokens de raciocínio 437,323 108,952
Tempo de resposta (médio) 32.88s 13.21s
Tempo de resposta (máx.) 276.31s 54.15s
Tempo de resposta (total) 756.34s 303.92s
Parâmetros 748B no total (16B ativos) ~1T no total (~50B ativos)
Disponibilidade Código aberto Código fechado

Os preços de cache aplicam-se aos tokens de entrada. A leitura reutiliza prompts em cache; a escrita armazena-os e pode custar mais. Os tokens de saída usam o preço de saída.

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#53 DeepSeek V4.1 Flash

medium
Custo
$0.014
Tempo
34.7s
Tokens
11,541 tok

#61 Muse Spark 1.1

low
Custo
$0.020
Tempo
39.2s
Tokens
4,947 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V4.1 Flash 10.0 10.0 100.0% 0 34.45s 7,509 396 71,345
Muse Spark 1.1 10.0 10.0 100.0% 0 10.34s 8,562 394 14,503

Trocar par de comparação