AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#40

DeepSeek V4 Flash 0731

DeepSeek Lançamento: 2026-08-01 Testado em: 2026-08-01 02:40 deepseek/deepseek-v4-flash-0731::high

Resumo

DeepSeek V4 Flash 0731 marca 8.0 no AI BENCHY e fica em #40. Tem fiabilidade 9.6, taxa de acerto de 78.8%, custo total de $0.123 e tempo médio de resposta de 110.77s.

O que torna DeepSeek V4 Flash 0731 único: Destaca-se mais em Combinado, onde fica em #1, enquanto Específico do domínio é a área mais fraca em #15. O custo total do benchmark é invulgarmente baixo para este nível de pontuação. Usa uma quantidade invulgarmente alta de tokens de raciocínio, o que pode explicar execuções mais lentas ou caras.

Consistência

7.8

Total de tokens de saída

544,164

Total de tokens de entrada

96,609

Preço de entrada

$0.140 / 1M

Preço de saída

$0.280 / 1M

Testes corretos

Testes errados: 8

Taxa de acerto por tentativa: 78.8%

Testes instáveis

6

Testes instáveis tiveram resultados mistos entre execuções (pelo menos um acerto e uma falha).

Tempo de resposta (médio)

110.77s

Tempo de resposta (máx.): 600.61s

Tempo de resposta (total): 2437.00s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#40 DeepSeek V4 Flash 0731

high
SVG inválido
Custo
$0.000
Tempo
187.3s
Tokens
19,048 tok

Histórico de preços

Dados históricos de preços deste modelo da OpenRouter.

Data Preço de entrada Preço de saída
2026-08-01 02:47 $0.140 / 1M $0.280 / 1M

Gráficos

Escolha o primeiro modelo e depois clique em um segundo modelo para abrir uma página lado a lado.

Total de tokens de saída

Pontuação vs Total de tokens de saída

Comparação rápida

Detalhamento por categoria

Categoria Pontuação Consistência Testes corretos
Truques anti-IA 8.7 7.9
Programação 6.3 4.2
Combinado 10.0 10.0
Análise e extração de dados 10.0 10.0
Específico do domínio 3.5 4.4
Inteligência geral 10.0 10.0
Seguimento de instruções 9.8 10.0
Resolução de quebra-cabeças 8.2 7.7
Chamada de ferramentas 10.0 10.0
Conhecimentos gerais 3.0 10.0

Modelos comparados