AI BENCHY Compare

DeepSeek: DeepSeek V4 Flash vs Qwen: Qwen3.5-27B

Rezumat

Comparație benchmark DeepSeek V4 Flash vs Qwen3.5-27B: Qwen3.5-27B conduce la scorul mediu cu 5.7 vs 5.0. DeepSeek V4 Flash are costul de benchmark mai mic, $0.008 vs $0.015. Qwen3.5-27B este mai rapid cu 1.68s vs 26.75s, cu rate de reușită de 30.2% vs 38.1%.

Model recomandat: Qwen3.5-27B - Are cel mai bun scor aici (5.7) și răspunde de aproximativ 15.9x mai rapid decât DeepSeek V4 Flash.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-04

Metrică	DeepSeek V4 Flash DeepSeek V4 Flash none Lansare: 2026-04-24	Qwen3.5-27B Qwen3.5-27B none Lansare: 2026-02-24

Metrică	DeepSeek V4 Flash DeepSeek V4 Flash none Lansare: 2026-04-24	Qwen3.5-27B Qwen3.5-27B none Lansare: 2026-02-24
Scor	5.0	5.7
Rang	#139	#115
Fiabilitate	10.0	10.0
Consistență	8.9	9.3
Teste corecte
Rată de trecere pe încercare	30.2%	38.1%
Teste instabile	3	2
Rulări totale	63	63
Cost per rezultat	0.203	0.249
Cost total	$0.008	$0.015
Preț de intrare	$0.099 / 1M	$0.195 / 1M
Preț de ieșire	$0.197 / 1M	$1.560 / 1M
Total tokenuri de intrare	50,127	44,478
Tokenuri de ieșire	13,710	3,592
Tokenuri de raționament	0	0
Timp de răspuns (mediu)	26.75s	1.68s
Timp de răspuns (maxim)	111.96s	9.39s
Timp de răspuns (total)	561.82s	35.25s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#139 DeepSeek V4 Flash

none

Cost: $0.004
Time: 157.6s
Tokens: 11,297 tok

#115 Qwen3.5-27B

none

Cost: $0.007
Time: 42.9s
Tokens: 4,273 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V4 Flash	3.0	10.0	0.0%	0		20.18s	540	174	0
Qwen3.5-27B	4.8	10.0	25.0%	0		788ms	696	267	0

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V4 Flash	4.2	7.4	11.1%	1		17.13s	7,279	9,717	0
Qwen3.5-27B	5.8	10.0	33.3%	0		1.80s	7,913	415	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V4 Flash	4.5	2.1	66.7%	1		111.96s	24,398	2,664	0
Qwen3.5-27B	2.8	1.6	33.3%	1		9.39s	16,918	1,461	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V4 Flash	10.0	10.0	100.0%	0		23.79s	7,290	195	0
Qwen3.5-27B	10.0	10.0	100.0%	0		1.43s	7,794	243	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V4 Flash	5.3	10.0	33.3%	0		19.73s	666	18	0
Qwen3.5-27B	3.0	10.0	0.0%	0		540ms	789	15	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V4 Flash	4.2	9.9	0.0%	0		23.74s	471	67	0
Qwen3.5-27B	5.0	10.0	0.0%	0		2.51s	522	126	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V4 Flash	6.5	10.0	50.0%	0		17.54s	627	321	0
Qwen3.5-27B	6.3	10.0	50.0%	0		1.03s	711	69	0

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V4 Flash	3.1	7.3	11.1%	1		23.72s	594	207	0
Qwen3.5-27B	6.7	7.9	55.6%	1		1.38s	714	683	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V4 Flash	10.0	10.0	100.0%	0		77.93s	8,079	327	0
Qwen3.5-27B	10.0	10.0	100.0%	0		3.54s	8,211	303	0

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V4 Flash	3.0	10.0	0.0%	0		3.07s	183	20	0
Qwen3.5-27B	3.0	10.0	0.0%	0		599ms	210	10	0

Comparație rapidă

Schimbă perechea de comparație

CobuddymediumvsQwen3.5-27Bnone Nemotron 3 SupermediumDisponibil gratuitvsQwen3.5-27Bnone DeepSeek V4 FlashnonevsMistral Small 4medium DeepSeek V4 FlashnonevsMiniMax M2.7medium DeepSeek V4 ProhighvsQwen3.5-27Bnone DeepSeek V4 FlashnonevsQwen3 Coder Nextmedium DeepSeek V4 FlashnonevsMiniMax M2.5medium MiniMax M2.5mediumvsQwen3.5-27Bnone MiniMax M2.7mediumvsQwen3.5-27Bnone Mistral Small 4mediumvsQwen3.5-27Bnone gpt-oss-120bmediumDisponibil gratuitvsQwen3.5-27Bnone DeepSeek V4 FlashnonevsGLM 4.7 Flashmedium