AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs Qwen: Qwen3.5 Plus 2026-04-20

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-04-27

Metrică	DeepSeek V3.2 DeepSeek V3.2 none Lansare: 2025-12-01	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none Lansare: 2026-04-20

Metrică	DeepSeek V3.2 DeepSeek V3.2 none Lansare: 2025-12-01	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 none Lansare: 2026-04-20
Scor	6.0	5.8
Rang	#82	#88
Fiabilitate	N/D	9.8
Consistență	8.6	8.3
Teste corecte
Rată de trecere pe încercare	46.3%	42.6%
Teste instabile	3	4
Rulări totale	52	54
Cost per rezultat	0.225	0.397
Cost total	$0.016	$0.024
Preț de intrare	$0.252 / 1M	$0.400 / 1M
Preț de ieșire	$0.378 / 1M	$2.400 / 1M
Tokenuri de ieșire	8,378	4,645
Tokenuri de raționament	0	0
Timp de răspuns (mediu)	12.07s	3.18s
Timp de răspuns (maxim)	115.89s	13.32s
Timp de răspuns (total)	217.28s	57.24s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	3.2	9.8	0.0%	0		7.63s	1,419	0
Qwen3.5 Plus 2026-04-20	4.8	10.0	25.0%	0		1.88s	557	0

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	2.4	1.3	33.3%	1		7.63s	553	0
Qwen3.5 Plus 2026-04-20	5.3	3.4	33.3%	1		3.20s	450	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	6.5	10.0	0.0%	0		115.89s	2,887	0
Qwen3.5 Plus 2026-04-20	2.8	1.6	33.3%	1		13.32s	2,275	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	6.3	5.8	66.7%	1		9.42s	1,710	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		2.82s	243	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	3.0	10.0	0.0%	0		1.52s	18	0
Qwen3.5 Plus 2026-04-20	5.3	10.0	33.3%	0		4.43s	18	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	10.0	10.0	100.0%	0		2.86s	67	0
Qwen3.5 Plus 2026-04-20	4.8	10.0	0.0%	0		1.41s	119	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	10.0	10.0	100.0%	0		1.52s	66	0
Qwen3.5 Plus 2026-04-20	6.2	5.8	66.7%	1		1.17s	68	0

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	8.5	7.5	88.9%	1		7.37s	1,136	0
Qwen3.5 Plus 2026-04-20	4.8	7.9	22.2%	1		2.03s	618	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	10.0	10.0	100.0%	0		11.85s	522	0
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		4.42s	297	0

Comparație rapidă

Schimbă perechea de comparație

gpt-oss-120bmediumDisponibil gratuitvsQwen3.5 Plus 2026-04-20none MiniMax M2.5mediumDisponibil gratuitvsQwen3.5 Plus 2026-04-20none Mistral Small 4mediumvsQwen3.5 Plus 2026-04-20none DeepSeek V3.2nonevsgpt-oss-120bmediumDisponibil gratuit DeepSeek V3.2nonevsGPT-5 Nanomedium DeepSeek V3.2nonevsMiniMax M2.5mediumDisponibil gratuit DeepSeek V3.2nonevsMistral Small 4medium GPT-5 NanomediumvsQwen3.5 Plus 2026-04-20none DeepSeek V3.2nonevsMercury 2medium MiniMax M2.7mediumvsQwen3.5 Plus 2026-04-20none Elephant AlphamediumvsQwen3.5 Plus 2026-04-20none DeepSeek V3.2nonevsGrok 4.1 Fastmedium