AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs DeepSeek: DeepSeek V3.2

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-01

Métrique	Seed-2.0-Lite Seed-2.0-Lite none Sortie: 2026-02-14	DeepSeek V3.2 DeepSeek V3.2 none Sortie: 2025-12-01

Métrique	Seed-2.0-Lite Seed-2.0-Lite none Sortie: 2026-02-14	DeepSeek V3.2 DeepSeek V3.2 none Sortie: 2025-12-01
Score	5.9	5.6
Rang	#106	#120
Fiabilité	10.0	10.0
Cohérence	8.3	8.3
Tests corrects
Taux de réussite par tentative	48.3%	41.7%
Tests instables	4	6
Exécutions totales	60	60
Coût par résultat	0.218	0.222
Coût total	$0.018	$0.018
Prix d'entrée	$0.250 / 1M	$0.252 / 1M
Prix de sortie	$2.000 / 1M	$0.378 / 1M
Jetons de sortie	3,253	11,159
Jetons de raisonnement	0	0
Temps de réponse (moy.)	2.48s	14.43s
Temps de réponse (max)	6.70s	115.89s
Temps de réponse (total)	49.67s	288.55s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	3.0	5.9	16.7%	2		2.43s	709	0
DeepSeek V3.2	3.2	8.2	8.3%	1		9.35s	1,073	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	6.8	9.9	50.0%	0		2.95s	404	0
DeepSeek V3.2	3.1	5.4	16.7%	1		20.87s	4,522	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	3.0	10.0	0.0%	0		6.59s	498	0
DeepSeek V3.2	6.5	10.0	0.0%	0		115.89s	2,887	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.82s	246	0
DeepSeek V3.2	6.3	5.8	66.7%	1		9.42s	1,710	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	3.6	7.2	22.2%	1		1.33s	17	0
DeepSeek V3.2	2.9	6.9	11.1%	1		4.17s	21	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.45s	294	0
DeepSeek V3.2	6.8	10.0	66.7%	1		9.32s	43	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.06s	73	0
DeepSeek V3.2	10.0	10.0	100.0%	0		1.52s	66	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	5.3	7.2	44.4%	1		2.78s	709	0
DeepSeek V3.2	8.3	10.0	77.8%	1		6.91s	298	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.94s	292	0
DeepSeek V3.2	10.0	10.0	100.0%	0		11.85s	522	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	3.0	10.0	0.0%	0		1.96s	11	0
DeepSeek V3.2	3.0	10.0	0.0%	0		17.23s	17	0

Comparaison rapide

Changer la paire de comparaison

Seed-2.0-LitenonevsOwl Alphamedium Seed-2.0-Litenonevsgpt-oss-120bmediumDisponible gratuitement Seed-2.0-LitenonevsNemotron 3 SupermediumDisponible gratuitement DeepSeek V3.2nonevsMiniMax M2.5medium CobuddymediumvsSeed-2.0-Litenone DeepSeek V3.2nonevsMistral Small 4medium CobuddymediumvsDeepSeek V3.2none DeepSeek V3.2nonevsElephant Alphamedium DeepSeek V3.2nonevsMiniMax M2.7medium Seed-2.0-LitenonevsGPT-5 Nanomedium DeepSeek V3.2nonevsOwl Alphamedium DeepSeek V3.2nonevsgpt-oss-120bmediumDisponible gratuitement