Navegação
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs Google: Gemini 3 Flash Preview

Resumo

Comparação benchmark DeepSeek V3.2 vs Gemini 3 Flash Preview: DeepSeek V3.2 lidera na pontuação média com 7.5 vs 7.4. DeepSeek V3.2 tem menor custo de benchmark com $0.044 vs $0.111. Gemini 3 Flash Preview é mais rápido com 5.76s vs 68.71s, com taxas de acerto de 65.1% vs 79.4%.

Modelo recomendado: Gemini 3 Flash Preview - A pontuação fica perto da melhor aqui (7.4 vs 7.5) e responde cerca de 11.9x mais rápido que DeepSeek V3.2.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-12

Métrica DeepSeek V3.2 DeepSeek V3.2 medium Lançamento: 2025-12-01 Gemini 3 Flash Preview Gemini 3 Flash Preview low Lançamento: 2025-12-17
Pontuação 7.5 7.4
Posição #50 #53
Confiabilidade 10.0 10.0
Consistência 7.6 9.2
Testes corretos
Taxa de acerto por tentativa 65.1% 79.4%
Testes instáveis 6 2
Execuções totais 63 63
Custo por resultado 0.436 0.689
Custo total $0.044 $0.111
Preço de entrada $0.229 / 1M $0.500 / 1M
Preço de saída $0.344 / 1M $3.000 / 1M
Total de tokens de entrada 38,333 36,769
Tokens de saída 7,186 2,076
Tokens de raciocínio 99,081 28,518
Tempo de resposta (médio) 68.71s 5.76s
Tempo de resposta (máx.) 376.10s 14.72s
Tempo de resposta (total) 1442.81s 120.93s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#50 DeepSeek V3.2

medium
Cost
$0.001
Time
53.6s
Tokens
1,932 tok

#53 Gemini 3 Flash Preview

low
Cost
$0.007
Time
12.1s
Tokens
2,289 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V3.2 8.2 7.9 83.3% 1 24.23s 448 3,247 6,953
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.48s 500 281 3,082
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
Gemini 3 Flash Preview 5.8 7.2 44.4% 1 6.00s 8,122 456 7,421
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V3.2 10.0 10.0 100.0% 0 93.11s 14,283 571 6,296
Gemini 3 Flash Preview 3.0 10.0 0.0% 0 3.27s 12,860 326 0
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V3.2 10.0 10.0 100.0% 0 36.09s 7,388 207 7,693
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 9.40s 7,261 279 3,656
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V3.2 2.9 4.4 22.2% 2 24.27s 472 21 6,838
Gemini 3 Flash Preview 5.3 7.2 44.4% 1 8.05s 645 12 6,410
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V3.2 3.4 2.5 33.3% 1 58.29s 314 49 2,189
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 3.68s 492 120 981
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V3.2 10.0 10.0 100.0% 0 35.78s 627 1,397 2,845
Gemini 3 Flash Preview 9.9 10.0 100.0% 0 7.02s 621 71 2,752
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V3.2 7.0 7.2 55.6% 1 37.69s 594 518 6,375
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 5.77s 562 288 3,168
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V3.2 10.0 10.0 100.0% 0 34.81s 8,307 507 859
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 4.99s 5,550 234 415
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V3.2 3.0 10.0 0.0% 0 83.99s 183 20 7,019
Gemini 3 Flash Preview 10.0 10.0 100.0% 0 2.75s 156 9 633

Comparação rápida

Trocar par de comparação