Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Qwen: Qwen3.5 Plus 2026-04-20

Сводка

Сравнение benchmark DeepSeek V4 Pro vs Qwen3.5 Plus 2026-04-20: DeepSeek V4 Pro лидирует по среднему баллу: 8.1 vs 7.8. DeepSeek V4 Pro имеет более низкую стоимость benchmark: $0.098 vs $0.317. Qwen3.5 Plus 2026-04-20 быстрее: 46.36s vs 72.22s, с долей успешных попыток 66.7% vs 66.7%.

Рекомендуемая модель: DeepSeek V4 Pro - Здесь у него лучший балл (8.1), при этом он примерно в 3.2 раза дешевле, чем Qwen3.5 Plus 2026-04-20.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-12

Метрика DeepSeek V4 Pro DeepSeek V4 Pro high Релиз: 2026-04-24 Qwen3.5 Plus 2026-04-20 Qwen3.5 Plus 2026-04-20 medium Релиз: 2026-04-20
Оценка 8.1 7.8
Ранг #30 #37
Надежность 9.6 10.0
Стабильность 7.8 9.0
Тестов верно
Доля успешных попыток 66.7% 66.7%
Нестабильные тесты 6 2
Всего запусков 57 63
Стоимость за результат 0.978 3.023
Общая стоимость $0.098 $0.317
Цена входа $0.435 / 1M $0.300 / 1M
Цена выхода $0.870 / 1M $1.800 / 1M
Общее число входных токенов 35,122 42,097
Выходные токены 6,315 2,280
Токены рассуждений 93,205 166,613
Время ответа (среднее) 72.22s 46.36s
Время ответа (макс.) 437.44s 189.38s
Время ответа (суммарно) 1444.45s 973.57s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 DeepSeek V4 Pro

high
Cost
$0.023
Time
257.6s
Tokens
14,870 tok

#37 Qwen3.5 Plus 2026-04-20

medium
Cost
$0.008
Time
76.7s
Tokens
4,355 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 5.7 5.9 58.3% 2 25.70s 536 149 3,214
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 10.84s 672 215 7,748
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 7.7 10.0 66.7% 0 308.19s 1,583 368 42,658
Qwen3.5 Plus 2026-04-20 6.2 8.7 33.3% 0 125.25s 7,630 308 58,682
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 10.0 10.0 100.0% 0 38.17s 14,060 454 5,836
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 92.41s 14,934 483 17,490
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 10.0 10.0 100.0% 0 25.03s 7,690 274 2,166
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 38.32s 7,782 270 14,668
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 3.6 7.2 22.2% 1 130.09s 472 4,400 26,367
Qwen3.5 Plus 2026-04-20 2.9 7.2 11.1% 1 53.10s 771 63 28,414
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 10.0 10.0 100.0% 0 8.83s 471 115 1,013
Qwen3.5 Plus 2026-04-20 4.9 9.6 0.0% 0 25.30s 516 125 4,792
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 7.8 6.6 83.3% 1 8.73s 627 66 2,726
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 20.25s 699 103 7,689
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 6.9 4.9 77.8% 2 56.85s 591 178 2,563
Qwen3.5 Plus 2026-04-20 8.2 7.2 88.9% 1 17.67s 696 338 9,800
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 9.8 10.0 100.0% 0 15.92s 8,909 295 701
Qwen3.5 Plus 2026-04-20 10.0 10.0 100.0% 0 14.72s 8,193 348 2,164
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 3.0 10.0 0.0% 0 34.01s 183 16 5,961
Qwen3.5 Plus 2026-04-20 3.0 10.0 0.0% 0 92.57s 204 27 15,166

Быстрое сравнение

Сменить пару сравнения