Navegação
AI BENCHY
Advertise here

DeepSeek V3.2 (medium) vs Gemini 3.5 Flash

A pontuação média está praticamente empatada em 7.0 vs 7.0. DeepSeek V3.2 (medium) tem menor custo de benchmark com $0.078 vs $1.079. Gemini 3.5 Flash é mais rápido com 9.93s vs 68.62s, com taxas de acerto de 65.2% vs 74.2%.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-08-11

Posição
#102
Total de tokens de saída
128,848
Tempo de resposta (médio)
68.62s
Custo total
$0.078
Posição
#105
Total de tokens de saída
117,518
Tempo de resposta (médio)
9.93s
Custo total
$1.079
Modelo recomendado DeepSeek V3.2 (medium)

Tem a melhor pontuação aqui (7.0) e custa cerca de 14.0x menos que Gemini 3.5 Flash.

Comparação detalhada

Métrica DeepSeek V3.2 DeepSeek V3.2 medium Lançamento: 2025-12-01 Gemini 3.5 Flash Gemini 3.5 Flash none Lançamento: 2026-05-19
Pontuação 7.0 7.0
Posição #102 #105
Confiabilidade 10.0 10.0
Consistência 7.4 8.9
Cobertura do benchmark 22/22 testes · 66/66 tentativas 22/22 testes · 66/66 tentativas
Testes corretos
Taxa de acerto por tentativa 65.2% 74.2%
Testes instáveis 7 3
Execuções totais 66 66
Custo por resultado 0.671 7.190
Custo total $0.078 $1.079
Preço de entrada $0.269 / 1M $1.500 / 1M
Preço de saída $0.400 / 1M $9.000 / 1M
Total de tokens de entrada 101,047 13,843
Tokens de saída 11,834 117,518
Tokens de raciocínio 117,014 0
Tempo de resposta (médio) 68.62s 9.93s
Tempo de resposta (máx.) 376.10s 64.36s
Tempo de resposta (total) 1509.53s 178.68s

Geração showcase de modelos

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#102 DeepSeek V3.2

medium
Custo
$0.001
Tempo
53.6s
Tokens
1,932 tok

#105 Gemini 3.5 Flash

none
Custo
$0.225
Tempo
125.5s
Tokens
25,004 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
Gemini 3.5 Flash 8.8 7.8 88.9% 1 34.69s 8,122 75,927 0

Comparação rápida

Trocar par de comparação