Navegação
AI BENCHY
Advertise here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs inclusionAI: Ling-2.6-flash

Resumo

Comparação benchmark DeepSeek V4 Pro vs Ling-2.6-flash: DeepSeek V4 Pro lidera na pontuação média com 5.7 vs 5.0. Ling-2.6-flash tem menor custo de benchmark com $0.001 vs $0.025. Ling-2.6-flash é mais rápido com 9.34s vs 12.38s, com taxas de acerto de 42.9% vs 31.8%.

Modelo recomendado: Ling-2.6-flash - A pontuação fica perto da melhor aqui (5.0 vs 5.7) e custa cerca de 49.0x menos que DeepSeek V4 Pro.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-04

Métrica DeepSeek V4 Pro DeepSeek V4 Pro none Lançamento: 2026-04-24 Ling-2.6-flash Ling-2.6-flash none Lançamento: 2026-04-21
Pontuação 5.7 5.0
Posição #113 #138
Confiabilidade 8.5 10.0
Consistência 8.5 9.2
Testes corretos
Taxa de acerto por tentativa 42.9% 31.8%
Testes instáveis 4 2
Execuções totais 63 63
Custo por resultado 0.660 0.005
Custo total $0.025 $0.001
Preço de entrada $0.435 / 1M $0.010 / 1M
Preço de saída $0.870 / 1M $0.030 / 1M
Total de tokens de entrada 44,845 40,718
Tokens de saída 5,349 2,878
Tokens de raciocínio 0 0
Tempo de resposta (médio) 12.38s 9.34s
Tempo de resposta (máx.) 58.65s 35.34s
Tempo de resposta (total) 260.06s 177.48s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#113 DeepSeek V4 Pro

none
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

#138 Ling-2.6-flash

none
No showcase result has been generated for this model yet.
Cost
$0.000
Time
-
Tokens
0 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V4 Pro 3.5 8.0 16.7% 1 14.02s 540 704 0
Ling-2.6-flash 6.8 8.1 58.3% 1 11.81s 726 573 0
Programação Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V4 Pro 4.6 7.9 22.2% 1 6.11s 7,279 531 0
Ling-2.6-flash 5.3 10.0 33.3% 0 11.21s 813 381 0
Combinado Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V4 Pro 9.5 10.0 100.0% 0 25.49s 20,773 1,911 0
Ling-2.6-flash 3.0 10.0 0.0% 0 35.34s 20,818 1,069 0
Análise e extração de dados Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V4 Pro 6.9 5.8 66.7% 1 30.54s 5,633 170 0
Ling-2.6-flash 6.5 10.0 50.0% 0 8.48s 8,004 246 0
Específico do domínio Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V4 Pro 5.3 10.0 33.3% 0 3.17s 666 18 0
Ling-2.6-flash 3.0 10.0 0.0% 0 4.95s 810 24 0
Inteligência geral Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V4 Pro 4.3 9.9 0.0% 0 3.75s 471 132 0
Ling-2.6-flash 4.0 10.0 0.0% 0 1.45s 540 109 0
Seguimento de instruções Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V4 Pro 6.3 10.0 50.0% 0 8.23s 627 64 0
Ling-2.6-flash 9.8 10.0 100.0% 0 5.52s 732 81 0
Resolução de quebra-cabeças Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V4 Pro 7.6 7.2 77.8% 1 15.95s 594 173 0
Ling-2.6-flash 2.9 7.2 11.1% 1 6.51s 729 151 0
Chamada de ferramentas Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V4 Pro 10.0 10.0 100.0% 0 5.92s 8,079 219 0
Ling-2.6-flash 3.0 10.0 0.0% 0 18.80s 7,324 229 0
Conhecimentos gerais Pontuação Consistência Taxa de acerto por tentativa Testes instáveis Testes corretos Tempo de resposta (médio) Tokens de entrada Tokens de saída Tokens de raciocínio
DeepSeek V4 Pro 3.0 10.0 0.0% 0 15.59s 183 1,427 0
Ling-2.6-flash 3.0 10.0 0.0% 0 1.06s 222 15 0

Comparação rápida

Trocar par de comparação