AI BENCHY Compare

inclusionAI: Ring-2.6-1T vs Qwen: Qwen3.5-27B

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-05-28

Métrica	Ring-2.6-1T Ring-2.6-1T medium Lançamento: 2026-05-10	Qwen3.5-27B Qwen3.5-27B medium Lançamento: 2026-02-24

Métrica	Ring-2.6-1T Ring-2.6-1T medium Lançamento: 2026-05-10	Qwen3.5-27B Qwen3.5-27B medium Lançamento: 2026-02-24
Pontuação	7.2	7.9
Posição	#66	#27
Confiabilidade	10.0	10.0
Consistência	8.7	8.9
Testes corretos
Taxa de acerto por tentativa	66.7%	73.3%
Testes instáveis	3	3
Execuções totais	60	60
Custo por resultado	0.000	4.532
Custo total	$0.033	$0.488
Preço de entrada	$0.075 / 1M	$0.195 / 1M
Preço de saída	$0.625 / 1M	$1.560 / 1M
Tokens de saída	21,752	2,569
Tokens de raciocínio	42,754	304,894
Tempo de resposta (médio)	61.29s	60.09s
Tempo de resposta (máx.)	304.19s	177.36s
Tempo de resposta (total)	1164.50s	1201.89s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Ring-2.6-1T	10.0	10.0	100.0%	0		42.21s	3,833	4,891
Qwen3.5-27B	8.7	7.9	91.7%	1		19.75s	569	31,505

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Ring-2.6-1T	10.0	10.0	100.0%	0		59.65s	1,369	3,985
Qwen3.5-27B	7.0	9.8	50.0%	0		123.86s	416	64,993

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Ring-2.6-1T	10.0	10.0	100.0%	0		304.19s	324	6,088
Qwen3.5-27B	10.0	10.0	100.0%	0		163.96s	483	9,991

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Ring-2.6-1T	6.5	10.0	50.0%	0		37.36s	840	1,937
Qwen3.5-27B	10.0	10.0	100.0%	0		30.26s	270	16,150

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Ring-2.6-1T	3.5	4.4	33.3%	2		64.92s	9,744	15,013
Qwen3.5-27B	5.3	10.0	33.3%	0		79.53s	43	52,368

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Ring-2.6-1T	4.1	10.0	0.0%	0		58.26s	150	583
Qwen3.5-27B	6.1	3.1	66.7%	1		101.41s	70	23,147

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Ring-2.6-1T	9.8	10.0	100.0%	0		11.78s	266	1,831
Qwen3.5-27B	10.0	10.0	100.0%	0		19.66s	97	11,638

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Ring-2.6-1T	5.9	7.2	55.6%	1		20.73s	697	2,479
Qwen3.5-27B	8.2	7.7	77.8%	1		59.60s	242	70,096

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Ring-2.6-1T	10.0	10.0	100.0%	0		104.44s	234	1,531
Qwen3.5-27B	10.0	10.0	100.0%	0		7.45s	348	1,323

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Ring-2.6-1T	3.0	10.0	0.0%	0		113.91s	4,295	4,416
Qwen3.5-27B	3.0	10.0	0.0%	0		85.11s	31	23,683

Comparação rápida

Trocar par de comparação

Claude Opus 4.8nonevsRing-2.6-1Tmedium Gemini 3.5 FlashminimalvsQwen3.5-27Bmedium GPT-5.2 ChatnonevsQwen3.5-27Bmedium Ring-2.6-1TmediumvsQwen3.6 Max Previewnone Ring-2.6-1TmediumvsGPT-5.3 Chatnone Gemini 3.1 Flash LitelowvsRing-2.6-1Tmedium Claude Sonnet 4.6nonevsRing-2.6-1Tmedium Gemini 3.1 Flash Lite PreviewnonevsRing-2.6-1Tmedium Gemini 3 Flash PreviewnonevsQwen3.5-27Bmedium DeepSeek V4 FlashhighDisponível grátisvsQwen3.5-27Bmedium Gemini 3.1 Flash Lite PreviewlowvsQwen3.5-27Bmedium Gemini 3.1 Flash Lite PreviewlowvsRing-2.6-1Tmedium