AI BENCHY Compare

Anthropic: Claude Opus 4.7 vs Qwen: Qwen3.6 Max Preview

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-04-27

Métrica	Claude Opus 4.7 Claude Opus 4.7 none Lançamento: 2026-04-16	Qwen3.6 Max Preview Qwen3.6 Max Preview medium Lançamento: 2026-04-20

Métrica	Claude Opus 4.7 Claude Opus 4.7 none Lançamento: 2026-04-16	Qwen3.6 Max Preview Qwen3.6 Max Preview medium Lançamento: 2026-04-20
Pontuação	9.2	8.8
Posição	#4	#8
Confiabilidade	N/D	10.0
Consistência	10.0	9.5
Testes corretos
Taxa de acerto por tentativa	88.9%	85.2%
Testes instáveis	0	1
Execuções totais	54	54
Custo por resultado	3.155	5.486
Custo total	$0.505	$0.823
Preço de entrada	$5.000 / 1M	$1.300 / 1M
Preço de saída	$25.000 / 1M	$7.800 / 1M
Tokens de saída	6,326	2,158
Tokens de raciocínio	0	97,495
Tempo de resposta (médio)	3.13s	48.31s
Tempo de resposta (máx.)	18.27s	186.74s
Tempo de resposta (total)	56.33s	869.64s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.7	8.3	10.0	75.0%	0		2.12s	522	0
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		22.13s	228	10,075

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.7	10.0	10.0	100.0%	0		2.84s	494	0
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		117.87s	368	13,790

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.7	9.5	10.0	100.0%	0		18.27s	3,504	0
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		121.49s	390	14,575

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.7	10.0	10.0	100.0%	0		2.15s	324	0
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		41.15s	270	10,106

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.7	7.7	10.0	66.7%	0		1.19s	78	0
Qwen3.6 Max Preview	2.9	7.2	11.1%	1		95.91s	60	30,371

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.7	10.0	10.0	100.0%	0		3.47s	257	0
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		32.24s	129	3,510

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.7	10.0	10.0	100.0%	0		1.46s	114	0
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		24.31s	103	5,848

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.7	10.0	10.0	100.0%	0		2.58s	661	0
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		24.19s	301	7,649

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Claude Opus 4.7	10.0	10.0	100.0%	0		4.74s	372	0
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		18.32s	309	1,571

Comparação rápida

Trocar par de comparação

Gemini 3 Flash PreviewlowvsQwen3.6 Max Previewmedium Claude Opus 4.7nonevsGPT-5.5low Claude Opus 4.7nonevsGPT-5.5medium GPT-5.5lowvsQwen3.6 Max Previewmedium Qwen3.6 Max PreviewmediumvsHY3 PreviewhighDisponível grátis Claude Opus 4.7nonevsGemini 3 Flash Previewlow Claude Opus 4.7nonevsGemini 3.1 Pro Previewmedium Claude Opus 4.7nonevsQwen3.6 35B A3Bmedium Claude Opus 4.7nonevsSeed-2.0-Litemedium Claude Opus 4.7nonevsGPT-5.3-Codexmedium Claude Opus 4.7nonevsQwen3.5 Plus 2026-02-15medium Qwen3.6 Max PreviewmediumvsHY3 PreviewlowDisponível grátis