AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs Qwen: Qwen3.5 Plus 2026-02-15

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-03-15

Metrică	DeepSeek V3.2 DeepSeek V3.2 medium Lansare: 2025-12-01	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Lansare: 2026-02-15

Metrică	DeepSeek V3.2 DeepSeek V3.2 medium Lansare: 2025-12-01	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Lansare: 2026-02-15
Rang	#14	#4
Scor	8.1	8.8
Consistență	8.5	9.5
Cost per rezultat	0.225	1.264
Cost total	$0.025	$0.165
Teste corecte
Rată de trecere pe încercare	79.2%	85.4%
Teste instabile	3	1
Rulări totale	48	48
Tokenuri de ieșire	7,392	1,735
Tokenuri de raționament	39,089	77,212
Timp de răspuns (mediu)	39.48s	34.45s
Timp de răspuns (maxim)	93.11s	79.86s
Timp de răspuns (total)	631.71s	310.09s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	7.8	9.9	66.7%	0		33.39s	1,171	4,893
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		10.37s	186	5,926

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	10.0	10.0	100.0%	0		93.11s	571	6,296
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		46.85s	421	7,906

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	10.0	10.0	100.0%	0		36.09s	207	7,693
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		46.91s	270	14,916

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	5.3	7.2	44.4%	1		39.32s	3,081	7,856
Qwen3.5 Plus 2026-02-15	5.3	10.0	33.3%	0		17.50s	35	16,680

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	5.4	2.5	66.7%	1		31.30s	68	2,366
Qwen3.5 Plus 2026-02-15	4.7	1.6	66.7%	1		79.86s	73	8,675

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	10.0	10.0	100.0%	0		35.78s	1,397	2,845
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		31.93s	101	7,704

Puzzle Solving	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	8.2	7.2	88.9%	1		36.87s	390	6,281
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		34.57s	340	14,496

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
DeepSeek V3.2	10.0	10.0	100.0%	0		34.81s	507	859
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		7.54s	309	909

Comparație rapidă

Schimbă perechea de comparație

DeepSeek V3.2mediumvsGPT-5.2 Chatnone Gemini 3 Flash PreviewlowvsQwen3.5 Plus 2026-02-15medium DeepSeek V3.2mediumvsGemini 3 Flash Previewnone DeepSeek V3.2mediumvsGemini 3.1 Flash Lite Previewlow DeepSeek V3.2mediumvsGPT-5.3 Chatnone DeepSeek V3.2mediumvsGemini 3.1 Flash Lite Previewnone DeepSeek V3.2mediumvsGemini 3 Flash Previewlow Claude Sonnet 4.6nonevsDeepSeek V3.2medium GPT-5.2 ChatnonevsQwen3.5 Plus 2026-02-15medium Gemini 3 Flash PreviewnonevsQwen3.5 Plus 2026-02-15medium Gemini 3.1 Flash Lite PreviewlowvsQwen3.5 Plus 2026-02-15medium GPT-5.3 ChatnonevsQwen3.5 Plus 2026-02-15medium