AI BENCHY Compare

Google: Gemini 3.5 Flash vs Qwen: Qwen3.6 35B A3B

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-05-19

Métrica	Gemini 3.5 Flash Gemini 3.5 Flash low Lançamento: 2026-05-19	Qwen3.6 35B A3B Qwen3.6 35B A3B medium Lançamento: 2026-04-20

Métrica	Gemini 3.5 Flash Gemini 3.5 Flash low Lançamento: 2026-05-19	Qwen3.6 35B A3B Qwen3.6 35B A3B medium Lançamento: 2026-04-20
Pontuação	9.6	8.0
Posição	#2	#26
Confiabilidade	10.0	9.8
Consistência	10.0	9.1
Testes corretos
Taxa de acerto por tentativa	94.7%	74.5%
Testes instáveis	0	2
Execuções totais	57	57
Custo por resultado	1.359	0.959
Custo total	$0.245	$0.116
Preço de entrada	$1.500 / 1M	$0.150 / 1M
Preço de saída	$9.000 / 1M	$1.000 / 1M
Tokens de saída	2,003	15,018
Tokens de raciocínio	20,245	108,331
Tempo de resposta (médio)	2.84s	13.22s
Tempo de resposta (máx.)	6.44s	45.02s
Tempo de resposta (total)	54.00s	224.66s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.52s	209	2,536
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		6.02s	1,154	12,385

Programação	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.5 Flash	10.0	10.0	100.0%	0		5.49s	428	3,146
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		32.58s	3,294	15,116

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.5 Flash	10.0	10.0	100.0%	0		6.44s	351	3,050
Qwen3.6 35B A3B	0.0	0.0	0.0%	0		0ms	0	0

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.5 Flash	10.0	10.0	100.0%	0		1.81s	279	1,164
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		12.99s	2,591	9,968

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.5 Flash	7.7	10.0	66.7%	0		3.39s	12	4,538
Qwen3.6 35B A3B	5.3	7.2	44.4%	1		22.50s	6,193	39,116

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.27s	119	916
Qwen3.6 35B A3B	4.4	9.9	0.0%	0		8.66s	129	4,569

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.5 Flash	9.9	10.0	100.0%	0		1.86s	71	1,652
Qwen3.6 35B A3B	10.0	10.0	100.0%	0		7.50s	219	7,404

Resolução de quebra-cabeças	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.5 Flash	10.0	10.0	100.0%	0		2.35s	288	2,150
Qwen3.6 35B A3B	7.9	7.5	77.8%	1		5.98s	676	9,447

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.5 Flash	10.0	10.0	100.0%	0		3.27s	234	403
Qwen3.6 35B A3B	0.0	0.0	0.0%	0		0ms	0	0

Conhecimentos gerais	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Gemini 3.5 Flash	10.0	10.0	100.0%	0		1.88s	12	690
Qwen3.6 35B A3B	3.0	10.0	0.0%	0		32.90s	762	10,326

Comparação rápida

Trocar par de comparação

Gemini 3.5 FlashminimalvsQwen3.6 35B A3Bmedium Gemini 3 Flash PreviewnonevsQwen3.6 35B A3Bmedium Gemini 3.1 Flash Lite PreviewlowvsQwen3.6 35B A3Bmedium Gemini 3.1 Flash Lite PreviewnonevsQwen3.6 35B A3Bmedium GPT-5.2 ChatnonevsQwen3.6 35B A3Bmedium Gemini 3.1 Flash LitelowvsQwen3.6 35B A3Bmedium GPT-5.3 ChatnonevsQwen3.6 35B A3Bmedium DeepSeek V4 FlashhighDisponível grátisvsQwen3.6 35B A3Bmedium Claude Opus 4.7mediumvsGemini 3.5 Flashlow Gemini 3.5 FlashlowvsGPT-5.5medium Ring-2.6-1TnonevsQwen3.6 35B A3Bmedium Gemini 3 Flash PreviewlowvsQwen3.6 35B A3Bmedium