AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Qwen: Qwen3.5 Plus 2026-04-20

Сводка

Сравнение benchmark DeepSeek V4 Pro vs Qwen3.5 Plus 2026-04-20: DeepSeek V4 Pro лидирует по среднему баллу: 8.1 vs 7.8. DeepSeek V4 Pro имеет более низкую стоимость benchmark: $0.098 vs $0.317. Qwen3.5 Plus 2026-04-20 быстрее: 46.36s vs 72.22s, с долей успешных попыток 66.7% vs 66.7%.

Рекомендуемая модель: DeepSeek V4 Pro - Здесь у него лучший балл (8.1), при этом он примерно в 3.2 раза дешевле, чем Qwen3.5 Plus 2026-04-20.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-12

Метрика	DeepSeek V4 Pro DeepSeek V4 Pro high Релиз: 2026-04-24	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium Релиз: 2026-04-20

Метрика	DeepSeek V4 Pro DeepSeek V4 Pro high Релиз: 2026-04-24	Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium Релиз: 2026-04-20
Оценка	8.1	7.8
Ранг	#30	#37
Надежность	9.6	10.0
Стабильность	7.8	9.0
Тестов верно
Доля успешных попыток	66.7%	66.7%
Нестабильные тесты	6	2
Всего запусков	57	63
Стоимость за результат	0.978	3.023
Общая стоимость	$0.098	$0.317
Цена входа	$0.435 / 1M	$0.300 / 1M
Цена выхода	$0.870 / 1M	$1.800 / 1M
Общее число входных токенов	35,122	42,097
Выходные токены	6,315	2,280
Токены рассуждений	93,205	166,613
Время ответа (среднее)	72.22s	46.36s
Время ответа (макс.)	437.44s	189.38s
Время ответа (суммарно)	1444.45s	973.57s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 DeepSeek V4 Pro

high

Cost: $0.023
Time: 257.6s
Tokens: 14,870 tok

#37 Qwen3.5 Plus 2026-04-20

medium

Cost: $0.008
Time: 76.7s
Tokens: 4,355 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	5.7	5.9	58.3%	2		25.70s	536	149	3,214
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		10.84s	672	215	7,748

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	7.7	10.0	66.7%	0		308.19s	1,583	368	42,658
Qwen3.5 Plus 2026-04-20	6.2	8.7	33.3%	0		125.25s	7,630	308	58,682

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	10.0	10.0	100.0%	0		38.17s	14,060	454	5,836
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		92.41s	14,934	483	17,490

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	10.0	10.0	100.0%	0		25.03s	7,690	274	2,166
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		38.32s	7,782	270	14,668

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	3.6	7.2	22.2%	1		130.09s	472	4,400	26,367
Qwen3.5 Plus 2026-04-20	2.9	7.2	11.1%	1		53.10s	771	63	28,414

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	10.0	10.0	100.0%	0		8.83s	471	115	1,013
Qwen3.5 Plus 2026-04-20	4.9	9.6	0.0%	0		25.30s	516	125	4,792

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	7.8	6.6	83.3%	1		8.73s	627	66	2,726
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		20.25s	699	103	7,689

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	6.9	4.9	77.8%	2		56.85s	591	178	2,563
Qwen3.5 Plus 2026-04-20	8.2	7.2	88.9%	1		17.67s	696	338	9,800

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	9.8	10.0	100.0%	0		15.92s	8,909	295	701
Qwen3.5 Plus 2026-04-20	10.0	10.0	100.0%	0		14.72s	8,193	348	2,164

Эрудиция	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Входные токены	Выходные токены	Токены рассуждений
DeepSeek V4 Pro	3.0	10.0	0.0%	0		34.01s	183	16	5,961
Qwen3.5 Plus 2026-04-20	3.0	10.0	0.0%	0		92.57s	204	27	15,166

Быстрое сравнение

Сменить пару сравнения