Claude Sonnet 4.6 vs Qwen3.5-27B (medium)

Modelo recomendado Claude Sonnet 4.6

A pontuação fica perto da melhor aqui (7.3 vs 7.4) e responde cerca de 13.8x mais rápido que Qwen3.5-27B (medium).

Comparação detalhada

Métrica	Claude Sonnet 4.6 Claude Sonnet 4.6 none Lançamento: 2026-02-17	Qwen3.5-27B Qwen3.5-27B medium Lançamento: 2026-02-24

Métrica	Claude Sonnet 4.6 Claude Sonnet 4.6 none Lançamento: 2026-02-17	Qwen3.5-27B Qwen3.5-27B medium Lançamento: 2026-02-24
Pontuação	7.3	7.4
Posição	#76	#71
Confiabilidade	10.0	10.0
Consistência	9.7	8.2
Testes corretos
Taxa de acerto por tentativa	57.6%	72.7%
Testes instáveis	1	5
Execuções totais	66	66
Custo por resultado	5.502	8.324
Custo total	$0.661	$0.981
Preço de entrada	$3.000 / 1M	$0.195 / 1M
Preço de saída	$15.000 / 1M	$1.560 / 1M
Total de tokens de entrada	123,264	111,635
Tokens de saída	19,362	15,999
Tokens de raciocínio	0	598,430
Tempo de resposta (médio)	8.12s	111.94s
Tempo de resposta (máx.)	51.18s	1026.43s
Tempo de resposta (total)	121.78s	2462.67s

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

none

medium

Categoria:

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Sonnet 4.6	4.8	10.0	25.0%	0		2.94s	636	1,214	0
Qwen3.5-27B	8.7	7.9	91.7%	1		19.75s	672	569	31,505

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Sonnet 4.6	5.5	10.0	33.3%	0		5.19s	8,522	2,127	0
Qwen3.5-27B	6.2	7.1	55.6%	1		160.69s	7,895	6,381	89,388

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Sonnet 4.6	9.8	10.0	100.0%	0		37.51s	91,402	13,663	0
Qwen3.5-27B	7.3	5.8	83.3%	1		595.19s	84,417	7,948	279,132

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Sonnet 4.6	10.0	10.0	100.0%	0		3.43s	8,574	252	0
Qwen3.5-27B	10.0	10.0	100.0%	0		30.26s	7,782	270	16,150

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Sonnet 4.6	7.7	10.0	66.7%	0		3.54s	759	413	0
Qwen3.5-27B	5.3	10.0	33.3%	0		79.53s	553	43	52,368

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Sonnet 4.6	6.1	3.1	66.7%	1		2.56s	513	192	0
Qwen3.5-27B	6.1	3.1	66.7%	1		101.41s	524	70	23,147

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Sonnet 4.6	6.5	10.0	50.0%	0		1.96s	690	90	0
Qwen3.5-27B	10.0	10.0	100.0%	0		19.66s	699	97	11,638

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Sonnet 4.6	7.7	10.0	66.7%	0		2.53s	663	533	0
Qwen3.5-27B	8.2	7.7	77.8%	1		59.60s	696	242	70,096

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Sonnet 4.6	10.0	10.0	100.0%	0		4.11s	11,301	447	0
Qwen3.5-27B	10.0	10.0	100.0%	0		7.45s	8,193	348	1,323

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Claude Sonnet 4.6	3.0	10.0	0.0%	0		4.67s	204	431	0
Qwen3.5-27B	3.0	10.0	0.0%	0		85.11s	204	31	23,683

Trocar par de comparação