AI BENCHY Compare

inclusionAI: Ling-2.6-flash vs Qwen: Qwen3.5 Plus 2026-04-20

Resumo

Comparação benchmark Ling-2.6-flash vs Qwen3.5 Plus 2026-04-20: Qwen3.5 Plus 2026-04-20 lidera na pontuação média com 5.7 vs 5.0. Ling-2.6-flash tem menor custo de benchmark com $0.001 vs $0.032. Qwen3.5 Plus 2026-04-20 é mais rápido com 4.39s vs 9.34s, com taxas de acerto de 31.8% vs 41.3%.

Modelo recomendado: Ling-2.6-flash - A pontuação fica perto da melhor aqui (5.0 vs 5.7) e custa cerca de 64.3x menos que Qwen3.5 Plus 2026-04-20.

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-06-04

Métrica	Ling-2.6-flash Ling-2.6-flash none Lançamento: 2026-04-21	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none Lançamento: 2026-04-20

Métrica	Ling-2.6-flash Ling-2.6-flash none Lançamento: 2026-04-21	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none Lançamento: 2026-04-20
Pontuação	5.0	5.7
Posição	#138	#114
Confiabilidade	10.0	10.0
Consistência	9.2	8.6
Testes corretos
Taxa de acerto por tentativa	31.8%	41.3%
Testes instáveis	2	4
Execuções totais	63	63
Custo por resultado	0.005	0.595
Custo total	$0.001	$0.032
Preço de entrada	$0.010 / 1M	$0.300 / 1M
Preço de saída	$0.030 / 1M	$1.800 / 1M
Total de tokens de entrada	40,718	38,910
Tokens de saída	2,878	11,145
Tokens de raciocínio	0	0
Tempo de resposta (médio)	9.34s	4.39s
Tempo de resposta (máx.)	35.34s	33.34s
Tempo de resposta (total)	177.48s	92.26s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#138 Ling-2.6-flash

none

No showcase result has been generated for this model yet.

Cost: $0.000
Time: -
Tokens: 0 tok

#114 Qwen3.5 Plus 2026-04-20

none

Cost: $0.008
Time: 77.0s
Tokens: 4,369 tok

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Ling-2.6-flash	6.8	8.1	58.3%	1		11.81s	726	573	0
Qwen3.5 Plus 2026-04-20	4.8	10.0	25.0%	0		1.88s	696	557	0

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Ling-2.6-flash	5.3	10.0	33.3%	0		11.21s	813	381	0
Qwen3.5 Plus 2026-04-20	3.9	7.8	11.1%	1		1.69s	7,913	480	0

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Ling-2.6-flash	3.0	10.0	0.0%	0		35.34s	20,818	1,069	0
Qwen3.5 Plus 2026-04-20	2.8	1.6	33.3%	1		13.32s	11,350	2,275	0

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Ling-2.6-flash	6.5	10.0	50.0%	0		8.48s	8,004	246	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		2.82s	7,794	243	0

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Ling-2.6-flash	3.0	10.0	0.0%	0		4.95s	810	24	0
Qwen3.5 Plus 2026-04-20	5.3	10.0	33.3%	0		4.43s	789	18	0

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Ling-2.6-flash	4.0	10.0	0.0%	0		1.45s	540	109	0
Qwen3.5 Plus 2026-04-20	4.8	10.0	0.0%	0		1.41s	522	119	0

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Ling-2.6-flash	9.8	10.0	100.0%	0		5.52s	732	81	0
Qwen3.5 Plus 2026-04-20	6.2	5.8	66.7%	1		1.17s	711	68	0

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Ling-2.6-flash	2.9	7.2	11.1%	1		6.51s	729	151	0
Qwen3.5 Plus 2026-04-20	6.7	7.9	55.6%	1		1.97s	714	583	0

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Ling-2.6-flash	3.0	10.0	0.0%	0		18.80s	7,324	229	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		4.42s	8,211	297	0

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de entrada	Tokens de saída	Tokens de raciocínio
Ling-2.6-flash	3.0	10.0	0.0%	0		1.06s	222	15	0
Qwen3.5 Plus 2026-04-20	3.0	10.0	0.0%	0		33.34s	210	6,505	0

Comparação rápida

Trocar par de comparação

CobuddymediumvsQwen3.5 Plus 2026-04-20none Nemotron 3 SupermediumDisponível grátisvsQwen3.5 Plus 2026-04-20none Ling-2.6-flashnonevsMistral Small 4medium Ling-2.6-flashnonevsMiniMax M2.7medium Ling-2.6-flashnonevsMiniMax M2.5medium DeepSeek V4 ProhighvsQwen3.5 Plus 2026-04-20none MiniMax M2.5mediumvsQwen3.5 Plus 2026-04-20none MiniMax M2.7mediumvsQwen3.5 Plus 2026-04-20none Mistral Small 4mediumvsQwen3.5 Plus 2026-04-20none Ling-2.6-flashnonevsQwen3 Coder Nextmedium gpt-oss-120bmediumDisponível grátisvsQwen3.5 Plus 2026-04-20none CobuddymediumvsLing-2.6-flashnone