AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Qwen: Qwen3.6 Max Preview

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-04-27

Métrique	Seed-2.0-Lite Seed-2.0-Lite medium Sortie: 2026-02-14	Qwen3.6 Max Preview Qwen3.6 Max Preview medium Sortie: 2026-04-20

Métrique	Seed-2.0-Lite Seed-2.0-Lite medium Sortie: 2026-02-14	Qwen3.6 Max Preview Qwen3.6 Max Preview medium Sortie: 2026-04-20
Score	8.6	8.8
Rang	#10	#8
Fiabilité	N/D	10.0
Cohérence	8.8	9.5
Tests corrects
Taux de réussite par tentative	83.3%	85.2%
Tests instables	3	1
Exécutions totales	54	54
Coût par résultat	0.926	5.486
Coût total	$0.121	$0.823
Prix d'entrée	$0.250 / 1M	$1.300 / 1M
Prix de sortie	$2.000 / 1M	$7.800 / 1M
Jetons de sortie	3,257	2,158
Jetons de raisonnement	52,042	97,495
Temps de réponse (moy.)	30.37s	48.31s
Temps de réponse (max)	168.71s	186.74s
Temps de réponse (total)	546.72s	869.64s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	8.3	10.0	75.0%	0		17.99s	996	7,142
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		22.13s	228	10,075

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	10.0	10.0	100.0%	0		74.49s	436	7,319
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		117.87s	368	13,790

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	10.0	10.0	100.0%	0		37.67s	506	4,299
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		121.49s	390	14,575

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	10.0	10.0	100.0%	0		9.07s	246	1,742
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		41.15s	270	10,106

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	5.9	7.2	55.6%	1		88.74s	15	23,897
Qwen3.6 Max Preview	2.9	7.2	11.1%	1		95.91s	60	30,371

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	6.7	3.6	66.7%	1		18.25s	304	1,620
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		32.24s	129	3,510

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	10.0	10.0	100.0%	0		7.26s	71	1,480
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		24.31s	103	5,848

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	9.0	7.9	88.9%	1		11.03s	461	3,532
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		24.19s	301	7,649

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	10.0	10.0	100.0%	0		12.38s	222	1,011
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		18.32s	309	1,571

Comparaison rapide

Changer la paire de comparaison

Gemini 3 Flash PreviewlowvsQwen3.6 Max Previewmedium Seed-2.0-LitemediumvsHY3 PreviewhighDisponible gratuitement GPT-5.5lowvsQwen3.6 Max Previewmedium Seed-2.0-LitemediumvsGemini 3 Flash Previewlow Qwen3.6 Max PreviewmediumvsHY3 PreviewhighDisponible gratuitement Claude Opus 4.7nonevsQwen3.6 Max Previewmedium Seed-2.0-LitemediumvsGPT-5.5low Seed-2.0-LitemediumvsHY3 PreviewlowDisponible gratuitement Seed-2.0-LitemediumvsGemini 3 Flash Previewnone Seed-2.0-LitemediumvsGemini 3.1 Flash Lite Previewlow Claude Opus 4.7nonevsSeed-2.0-Litemedium Seed-2.0-LitemediumvsGPT-5.2 Chatnone