AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Qwen: Qwen3.6 Max Preview

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-04-27

Metrică	Seed-2.0-Lite Seed-2.0-Lite medium Lansare: 2026-02-14	Qwen3.6 Max Preview Qwen3.6 Max Preview medium Lansare: 2026-04-20

Metrică	Seed-2.0-Lite Seed-2.0-Lite medium Lansare: 2026-02-14	Qwen3.6 Max Preview Qwen3.6 Max Preview medium Lansare: 2026-04-20
Scor	8.6	8.8
Rang	#10	#8
Fiabilitate	N/D	10.0
Consistență	8.8	9.5
Teste corecte
Rată de trecere pe încercare	83.3%	85.2%
Teste instabile	3	1
Rulări totale	54	54
Cost per rezultat	0.926	5.486
Cost total	$0.121	$0.823
Preț de intrare	$0.250 / 1M	$1.300 / 1M
Preț de ieșire	$2.000 / 1M	$7.800 / 1M
Tokenuri de ieșire	3,257	2,158
Tokenuri de raționament	52,042	97,495
Timp de răspuns (mediu)	30.37s	48.31s
Timp de răspuns (maxim)	168.71s	186.74s
Timp de răspuns (total)	546.72s	869.64s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	8.3	10.0	75.0%	0		17.99s	996	7,142
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		22.13s	228	10,075

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		74.49s	436	7,319
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		117.87s	368	13,790

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		37.67s	506	4,299
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		121.49s	390	14,575

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		9.07s	246	1,742
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		41.15s	270	10,106

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	5.9	7.2	55.6%	1		88.74s	15	23,897
Qwen3.6 Max Preview	2.9	7.2	11.1%	1		95.91s	60	30,371

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	6.7	3.6	66.7%	1		18.25s	304	1,620
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		32.24s	129	3,510

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		7.26s	71	1,480
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		24.31s	103	5,848

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	9.0	7.9	88.9%	1		11.03s	461	3,532
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		24.19s	301	7,649

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Seed-2.0-Lite	10.0	10.0	100.0%	0		12.38s	222	1,011
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		18.32s	309	1,571

Comparație rapidă

Schimbă perechea de comparație

Gemini 3 Flash PreviewlowvsQwen3.6 Max Previewmedium Seed-2.0-LitemediumvsHY3 PreviewhighDisponibil gratuit GPT-5.5lowvsQwen3.6 Max Previewmedium Seed-2.0-LitemediumvsGemini 3 Flash Previewlow Qwen3.6 Max PreviewmediumvsHY3 PreviewhighDisponibil gratuit Claude Opus 4.7nonevsQwen3.6 Max Previewmedium Seed-2.0-LitemediumvsGPT-5.5low Seed-2.0-LitemediumvsHY3 PreviewlowDisponibil gratuit Seed-2.0-LitemediumvsGemini 3 Flash Previewnone Seed-2.0-LitemediumvsGemini 3.1 Flash Lite Previewlow Claude Opus 4.7nonevsSeed-2.0-Litemedium Seed-2.0-LitemediumvsGPT-5.2 Chatnone