AI BENCHY Compare

DeepSeek: DeepSeek V3.2 vs Qwen: Qwen3.6 Max Preview

Сводка

Сравнение benchmark DeepSeek V3.2 vs Qwen3.6 Max Preview: DeepSeek V3.2 лидирует по среднему баллу: 7.5 vs 6.0. DeepSeek V3.2 имеет более низкую стоимость benchmark: $0.044 vs $0.075. Qwen3.6 Max Preview быстрее: 3.30s vs 68.71s, с долей успешных попыток 65.1% vs 58.7%.

Рекомендуемая модель: DeepSeek V3.2 - Здесь у него лучший балл (7.5), при этом он примерно в 1.7 раза дешевле, чем Qwen3.6 Max Preview.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-18

Метрика	DeepSeek V3.2 DeepSeek V3.2 medium Релиз: 2025-12-01	Qwen3.6 Max Preview Qwen3.6 Max Preview none Релиз: 2026-04-20

Метрика	DeepSeek V3.2 DeepSeek V3.2 medium Релиз: 2025-12-01	Qwen3.6 Max Preview Qwen3.6 Max Preview none Релиз: 2026-04-20
Оценка	7.5	6.0
Ранг	#48	#100
Надежность	10.0	10.0
Стабильность	7.6	9.2
Тестов верно
Доля успешных попыток	65.1%	58.7%
Нестабильные тесты	6	2
Всего запусков	63	63
Стоимость за результат	0.436	0.824
Общая стоимость	$0.044	$0.075
Цена входа	$0.229 / 1M	$1.040 / 1M
Цена выхода	$0.344 / 1M	$6.240 / 1M
Общее число входных токенов	38,333	42,509
Выходные токены	7,186	4,779
Токены рассуждений	99,081	0
Время ответа (среднее)	68.71s	3.30s
Время ответа (макс.)	376.10s	20.51s
Время ответа (суммарно)	1442.81s	69.40s

Генерация showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#48 DeepSeek V3.2

medium

Стоимость: $0.001
Время: 53.6s
Токены: 1,932 tok

#100 Qwen3.6 Max Preview

none

Стоимость: $0.025
Время: 83.9s
Токены: 4,066 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V3.2	8.2	7.9	83.3%	1		24.23s	448	3,247	6,953
Qwen3.6 Max Preview	5.2	7.9	41.7%	1		2.63s	696	513	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V3.2	6.0	7.2	55.6%	1		248.68s	5,717	649	52,014
Qwen3.6 Max Preview	3.8	7.3	22.2%	1		3.12s	7,913	456	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V3.2	10.0	10.0	100.0%	0		93.11s	14,283	571	6,296
Qwen3.6 Max Preview	3.0	10.0	0.0%	0		20.51s	14,949	2,842	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V3.2	10.0	10.0	100.0%	0		36.09s	7,388	207	7,693
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		2.87s	7,794	243	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V3.2	2.9	4.4	22.2%	2		24.27s	472	21	6,838
Qwen3.6 Max Preview	7.7	10.0	66.7%	0		1.22s	789	18	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V3.2	3.4	2.5	33.3%	1		58.29s	314	49	2,189
Qwen3.6 Max Preview	4.3	10.0	0.0%	0		1.62s	522	76	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V3.2	10.0	10.0	100.0%	0		35.78s	627	1,397	2,845
Qwen3.6 Max Preview	9.8	10.0	100.0%	0		1.40s	711	69	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V3.2	7.0	7.2	55.6%	1		37.69s	594	518	6,375
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		2.65s	714	321	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V3.2	10.0	10.0	100.0%	0		34.81s	8,307	507	859
Qwen3.6 Max Preview	10.0	10.0	100.0%	0		5.27s	8,211	222	0

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V3.2	3.0	10.0	0.0%	0		83.99s	183	20	7,019
Qwen3.6 Max Preview	3.0	10.0	0.0%	0		1.97s	210	19	0

Быстрое сравнение

Сменить пару сравнения

DeepSeek V3.2mediumvsGPT-5.3 Chatnone DeepSeek V3.2mediumvsGemini 3 Flash Previewlow Gemini 3.1 Flash LiteminimalvsQwen3.6 Max Previewnone North Mini CodemediumБесплатно доступноvsQwen3.6 Max Previewnone Claude Sonnet 4.6nonevsDeepSeek V3.2medium Claude Opus 4.8nonevsDeepSeek V3.2medium DeepSeek V3.2mediumvsStep 3.7 Flashlow DeepSeek V3.2mediumvsQwen3.7 Plusnone Gemma 4 31BmediumБесплатно доступноvsQwen3.6 Max Previewnone DeepSeek V3.2mediumvsGLM 5.2none Nemotron 3 SupermediumБесплатно доступноvsQwen3.6 Max Previewnone DeepSeek V3.2mediumvsStep 3.7 Flashhigh