AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs inclusionAI: Ring-2.6-1T

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-01

Métrica	DeepSeek V3.2 DeepSeek V3.2 medium Lançamento: 2025-12-01	Ring-2.6-1T Ring-2.6-1T medium Lançamento: 2026-05-10

Métrica	DeepSeek V3.2 DeepSeek V3.2 medium Lançamento: 2025-12-01	Ring-2.6-1T Ring-2.6-1T medium Lançamento: 2026-05-10
Pontuação	6.9	7.2
Posição	#81	#69
Confiabilidade	10.0	10.0
Consistência	7.9	8.7
Testes corretos
Taxa de acerto por tentativa	63.3%	66.7%
Testes instáveis	6	3
Execuções totais	60	60
Custo por resultado	0.335	0.000
Custo total	$0.037	$0.132
Preço de entrada	$0.252 / 1M	$0.300 / 1M
Preço de saída	$0.378 / 1M	$2.500 / 1M
Tokens de saída	7,177	21,752
Tokens de raciocínio	68,297	42,754
Tempo de resposta (médio)	53.34s	61.29s
Tempo de resposta (máx.)	189.03s	304.19s
Tempo de resposta (total)	1066.71s	1164.50s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
DeepSeek V3.2	8.7	10.0	83.3%	1		24.23s	3,247	6,953
Ring-2.6-1T	10.0	10.0	100.0%	0		42.21s	3,833	4,891

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
DeepSeek V3.2	3.9	5.8	33.3%	1		184.97s	640	21,230
Ring-2.6-1T	10.0	10.0	100.0%	0		59.65s	1,369	3,985

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
DeepSeek V3.2	10.0	10.0	100.0%	0		93.11s	571	6,296
Ring-2.6-1T	10.0	10.0	100.0%	0		304.19s	324	6,088

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
DeepSeek V3.2	10.0	10.0	100.0%	0		36.09s	207	7,693
Ring-2.6-1T	6.5	10.0	50.0%	0		37.36s	840	1,937

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
DeepSeek V3.2	2.9	4.4	22.2%	2		24.27s	21	6,838
Ring-2.6-1T	3.5	4.4	33.3%	2		64.92s	9,744	15,013

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
DeepSeek V3.2	3.4	2.5	33.3%	1		58.29s	49	2,189
Ring-2.6-1T	4.1	10.0	0.0%	0		58.26s	150	583

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
DeepSeek V3.2	10.0	10.0	100.0%	0		35.78s	1,397	2,845
Ring-2.6-1T	9.8	10.0	100.0%	0		11.78s	266	1,831

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
DeepSeek V3.2	7.0	7.2	55.6%	1		37.69s	518	6,375
Ring-2.6-1T	5.9	7.2	55.6%	1		20.73s	697	2,479

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
DeepSeek V3.2	10.0	10.0	100.0%	0		34.81s	507	859
Ring-2.6-1T	10.0	10.0	100.0%	0		104.44s	234	1,531

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
DeepSeek V3.2	3.0	10.0	0.0%	0		83.99s	20	7,019
Ring-2.6-1T	3.0	10.0	0.0%	0		113.91s	4,295	4,416

Comparação rápida

Trocar par de comparação

Claude Opus 4.8nonevsRing-2.6-1Tmedium Ring-2.6-1TmediumvsStep 3.7 Flashhigh Claude Sonnet 4.6nonevsDeepSeek V3.2medium Ring-2.6-1TmediumvsStep 3.7 Flashlow Ring-2.6-1TmediumvsQwen3.6 Max Previewnone Ring-2.6-1TmediumvsGPT-5.3 Chatnone Gemini 3.1 Flash LitelowvsRing-2.6-1Tmedium DeepSeek V3.2mediumvsQwen3.6 Max Previewnone DeepSeek V3.2mediumvsGemma 4 31BnoneDisponível grátis Claude Sonnet 4.6nonevsRing-2.6-1Tmedium Gemini 3.1 Flash Lite PreviewnonevsRing-2.6-1Tmedium DeepSeek V3.2mediumvsStep 3.7 Flashhigh