AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Qwen: Qwen3.5 Plus 2026-02-15

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-04-26

Métrique	Seed-2.0-Lite Seed-2.0-Lite medium Sortie: 2026-02-14	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Sortie: 2026-02-15

Métrique	Seed-2.0-Lite Seed-2.0-Lite medium Sortie: 2026-02-14	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Sortie: 2026-02-15
Score	8.6	8.5
Rang	#8	#10
Fiabilité	N/D	N/D
Cohérence	8.8	9.1
Tests corrects
Taux de réussite par tentative	83.3%	83.3%
Tests instables	3	2
Exécutions totales	54	54
Coût par résultat	0.926	1.566
Coût total	$0.121	$0.220
Prix d'entrée	$0.250 / 1M	$0.260 / 1M
Prix de sortie	$2.000 / 1M	$1.560 / 1M
Jetons de sortie	3,257	2,121
Jetons de raisonnement	52,042	111,889
Temps de réponse (moy.)	30.37s	46.56s
Temps de réponse (max)	168.71s	120.91s
Temps de réponse (total)	546.72s	512.20s

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	8.3	10.0	75.0%	0		17.99s	996	7,142
Qwen3.5 Plus 2026-02-15	8.2	7.9	83.3%	1		45.78s	205	21,236

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	10.0	10.0	100.0%	0		74.49s	436	7,319
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		120.91s	367	19,367

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	10.0	10.0	100.0%	0		37.67s	506	4,299
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		46.85s	421	7,906

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	10.0	10.0	100.0%	0		9.07s	246	1,742
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		46.91s	270	14,916

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	5.9	7.2	55.6%	1		88.74s	15	23,897
Qwen3.5 Plus 2026-02-15	5.3	10.0	33.3%	0		17.50s	35	16,680

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	6.7	3.6	66.7%	1		18.25s	304	1,620
Qwen3.5 Plus 2026-02-15	4.7	1.6	66.7%	1		79.86s	73	8,675

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	10.0	10.0	100.0%	0		7.26s	71	1,480
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		31.93s	101	7,704

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	9.0	7.9	88.9%	1		11.03s	461	3,532
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		34.57s	340	14,496

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons de sortie	Jetons de raisonnement
Seed-2.0-Lite	10.0	10.0	100.0%	0		12.38s	222	1,011
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		7.54s	309	909

Comparaison rapide

Changer la paire de comparaison

Qwen3.5 Plus 2026-02-15mediumvsHY3 PreviewhighDisponible gratuitement Seed-2.0-LitemediumvsHY3 PreviewhighDisponible gratuitement Seed-2.0-LitemediumvsGemini 3 Flash Previewlow Gemini 3 Flash PreviewlowvsQwen3.5 Plus 2026-02-15medium Qwen3.5 Plus 2026-02-15mediumvsHY3 PreviewlowDisponible gratuitement Gemini 3 Flash PreviewnonevsQwen3.5 Plus 2026-02-15medium Gemini 3.1 Flash Lite PreviewlowvsQwen3.5 Plus 2026-02-15medium Seed-2.0-LitemediumvsGPT-5.5low Seed-2.0-LitemediumvsHY3 PreviewlowDisponible gratuitement Seed-2.0-LitemediumvsGemini 3 Flash Previewnone Seed-2.0-LitemediumvsGemini 3.1 Flash Lite Previewlow GPT-5.5lowvsQwen3.5 Plus 2026-02-15medium