AI BENCHY Compare

DeepSeek: DeepSeek V4 Flash vs Qwen: Qwen3.5-27B

Résumé

Comparaison benchmark DeepSeek V4 Flash vs Qwen3.5-27B : Qwen3.5-27B mène au score moyen avec 5.7 vs 5.0. DeepSeek V4 Flash a le coût de benchmark le plus bas avec $0.008 vs $0.015. Qwen3.5-27B est plus rapide avec 1.68s vs 26.75s, avec des taux de réussite de 30.2% vs 38.1%.

Modèle recommandé: Qwen3.5-27B - Il obtient le meilleur score ici (5.7) et répond environ 15.9x plus vite que DeepSeek V4 Flash.

Benchmarks générés à partir des suites de tests AI BENCHY le: 2026-06-04

Métrique	DeepSeek V4 Flash DeepSeek V4 Flash none Sortie: 2026-04-24	Qwen3.5-27B Qwen3.5-27B none Sortie: 2026-02-24

Métrique	DeepSeek V4 Flash DeepSeek V4 Flash none Sortie: 2026-04-24	Qwen3.5-27B Qwen3.5-27B none Sortie: 2026-02-24
Score	5.0	5.7
Rang	#139	#115
Fiabilité	10.0	10.0
Cohérence	8.9	9.3
Tests corrects
Taux de réussite par tentative	30.2%	38.1%
Tests instables	3	2
Exécutions totales	63	63
Coût par résultat	0.203	0.249
Coût total	$0.008	$0.015
Prix d'entrée	$0.099 / 1M	$0.195 / 1M
Prix de sortie	$0.197 / 1M	$1.560 / 1M
Total des jetons d'entrée	50,127	44,478
Jetons de sortie	13,710	3,592
Jetons de raisonnement	0	0
Temps de réponse (moy.)	26.75s	1.68s
Temps de réponse (max)	111.96s	9.39s
Temps de réponse (total)	561.82s	35.25s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#139 DeepSeek V4 Flash

none

Cost: $0.004
Time: 157.6s
Tokens: 11,297 tok

#115 Qwen3.5-27B

none

Cost: $0.007
Time: 42.9s
Tokens: 4,273 tok

Meilleurs modèles par score

Score vs coût total

Temps de réponse (moy.)

Score vs Temps de réponse (moy.)

Total des jetons de sortie

Score vs Total des jetons de sortie

Répartition par catégorie

Astuces anti-IA	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Flash	3.0	10.0	0.0%	0		20.18s	540	174	0
Qwen3.5-27B	4.8	10.0	25.0%	0		788ms	696	267	0

Programmation	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Flash	4.2	7.4	11.1%	1		17.13s	7,279	9,717	0
Qwen3.5-27B	5.8	10.0	33.3%	0		1.80s	7,913	415	0

Combiné	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Flash	4.5	2.1	66.7%	1		111.96s	24,398	2,664	0
Qwen3.5-27B	2.8	1.6	33.3%	1		9.39s	16,918	1,461	0

Analyse et extraction des données	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Flash	10.0	10.0	100.0%	0		23.79s	7,290	195	0
Qwen3.5-27B	10.0	10.0	100.0%	0		1.43s	7,794	243	0

Spécifique au domaine	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Flash	5.3	10.0	33.3%	0		19.73s	666	18	0
Qwen3.5-27B	3.0	10.0	0.0%	0		540ms	789	15	0

Intelligence générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Flash	4.2	9.9	0.0%	0		23.74s	471	67	0
Qwen3.5-27B	5.0	10.0	0.0%	0		2.51s	522	126	0

Suivi des instructions	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Flash	6.5	10.0	50.0%	0		17.54s	627	321	0
Qwen3.5-27B	6.3	10.0	50.0%	0		1.03s	711	69	0

Résolution d'énigmes	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Flash	3.1	7.3	11.1%	1		23.72s	594	207	0
Qwen3.5-27B	6.7	7.9	55.6%	1		1.38s	714	683	0

Appel d'outils	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Flash	10.0	10.0	100.0%	0		77.93s	8,079	327	0
Qwen3.5-27B	10.0	10.0	100.0%	0		3.54s	8,211	303	0

Culture générale	Score	Cohérence	Taux de réussite par tentative	Tests instables	Tests corrects	Temps de réponse (moy.)	Jetons d'entrée	Jetons de sortie	Jetons de raisonnement
DeepSeek V4 Flash	3.0	10.0	0.0%	0		3.07s	183	20	0
Qwen3.5-27B	3.0	10.0	0.0%	0		599ms	210	10	0

Comparaison rapide

Changer la paire de comparaison

CobuddymediumvsQwen3.5-27Bnone Nemotron 3 SupermediumDisponible gratuitementvsQwen3.5-27Bnone DeepSeek V4 FlashnonevsMistral Small 4medium DeepSeek V4 FlashnonevsMiniMax M2.7medium DeepSeek V4 ProhighvsQwen3.5-27Bnone DeepSeek V4 FlashnonevsQwen3 Coder Nextmedium DeepSeek V4 FlashnonevsMiniMax M2.5medium MiniMax M2.5mediumvsQwen3.5-27Bnone MiniMax M2.7mediumvsQwen3.5-27Bnone Mistral Small 4mediumvsQwen3.5-27Bnone gpt-oss-120bmediumDisponible gratuitementvsQwen3.5-27Bnone DeepSeek V4 FlashnonevsGLM 4.7 Flashmedium