AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Qwen: Qwen3.5-35B-A3B

Benchmarks gerados a partir das suítes de teste do AI BENCHY em: 2026-03-12

Métrica	Seed-2.0-Lite Seed-2.0-Lite none Lançamento: 2026-02-14	Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Lançamento: 2026-02-24

Métrica	Seed-2.0-Lite Seed-2.0-Lite none Lançamento: 2026-02-14	Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Lançamento: 2026-02-24
Posição	#45	#39
Pontuação média	4.9	5.5
Consistência	7.4	6.3
Custo por resultado	0.214	4.251
Custo total	$0.015	$0.341
Testes corretos
Taxa de acerto por tentativa	56.3%	77.1%
Testes instáveis	5	7
Execuções totais	48	48
Tokens de saída	2,743	5,495
Tokens de raciocínio	0	169,266
Tempo de resposta (médio)	2.49s	43.93s
Tempo de resposta (máx.)	6.70s	106.00s
Tempo de resposta (total)	39.91s	702.85s

Melhores modelos por pontuação

Pontuação vs custo total

Tempo de resposta (médio)

Pontuação média vs Tempo de resposta (médio)

Total de tokens de saída

Pontuação média vs Total de tokens de saída

Detalhamento por categoria

Truques anti-IA	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	10.0	4.6	22.2%	2		2.93s	703	0
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		21.75s	429	36,235

Combinado	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	10.0	10.0	0.0%	0		6.59s	498	0
Qwen3.5-35B-A3B	10.0	1.6	66.7%	1		75.34s	775	12,485

Análise e extração de dados	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	9.9	10.0	100.0%	0		1.82s	246	0
Qwen3.5-35B-A3B	5.5	5.9	83.3%	1		59.33s	235	19,493

Específico do domínio	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	10.0	7.2	22.2%	1		1.33s	17	0
Qwen3.5-35B-A3B	10.0	4.4	44.5%	2		88.34s	41	46,368

Inteligência geral	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.45s	294	0
Qwen3.5-35B-A3B	10.0	1.6	33.3%	1		30.30s	20	3,753

Seguimento de instruções	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.06s	73	0
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		24.45s	97	17,361

Puzzle Solving	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	4.0	4.4	55.6%	2		2.46s	620	0
Qwen3.5-35B-A3B	4.0	4.4	77.8%	2		31.58s	3,589	32,206

Chamada de ferramentas	Pontuação	Consistência	Taxa de acerto por tentativa	Testes instáveis	Testes corretos	Tempo de resposta (médio)	Tokens de saída	Tokens de raciocínio
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.94s	292	0
Qwen3.5-35B-A3B	10.0	10.0	100.0%	0		4.65s	309	1,365

Comparação rápida

Trocar par de comparação

DeepSeek V3.2nonevsQwen3.5-35B-A3Bmedium Seed-2.0-LitenonevsGrok 4.20 Multi-Agent Betamedium Seed-2.0-Litenonevsgpt-oss-120bmediumDisponível grátis Seed-2.0-LitenonevsMiniMax M2.5medium Gemini 2.5 FlashnonevsQwen3.5-35B-A3Bmedium Seed-2.0-LitenonevsMercury 2medium Qwen3.5-35B-A3BmediumvsGLM 5none Seed-2.0-LitenonevsGPT-5 Nanomedium Seed-2.0-LitenonevsNemotron 3 Super 120b A12bmediumDisponível grátis Hunter AlphanonevsQwen3.5-35B-A3Bmedium Seed-2.0-LitenonevsHunter Alphamedium GPT-5.4nonevsQwen3.5-35B-A3Bmedium