Навигация
AI BENCHY
Advertise here

DeepSeek: DeepSeek V3.2 vs Qwen: Qwen3.5-9B

Qwen3.5-9B лидирует по среднему баллу: 5.1 vs 5.0. Qwen3.5-9B имеет более низкую стоимость benchmark: $0.021 vs $0.054. DeepSeek V3.2 быстрее: 18.25s vs 19.17s, с долей успешных попыток 37.9% vs 19.7%.

Рекомендуемая модельQwen3.5-9BЗдесь у него лучший балл (5.1), при этом он примерно в 2.7 раза дешевле, чем DeepSeek V3.2.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-25

Метрика DeepSeek V3.2 DeepSeek V3.2 none Релиз: 2025-12-01 Qwen3.5-9B Qwen3.5-9B none Релиз: 2026-03-02
Оценка 5.0 5.1
Ранг #188 #183
Надежность 10.0 10.0
Стабильность 7.7 9.7
Тестов верно
Доля успешных попыток 37.9% 19.7%
Нестабильные тесты 6 1
Всего запусков 66 66
Стоимость за результат 0.870 0.490
Общая стоимость $0.054 $0.021
Цена входа $0.269 / 1M $0.100 / 1M
Цена выхода $0.400 / 1M $0.150 / 1M
Общее число входных токенов 135,780 144,407
Выходные токены 42,097 37,484
Токены рассуждений 0 0
Время ответа (среднее) 18.25s 19.17s
Время ответа (макс.) 115.89s 382.06s
Время ответа (суммарно) 401.60s 421.74s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#188 DeepSeek V3.2

none
Стоимость
$0.002
Время
7.0s
Токены
1,046 tok

#183 Qwen3.5-9B

none
Неверный SVG
Стоимость
$0.000
Время
300.0s
Токены
0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V3.2 3.1 6.9 11.1% 1 14.54s 7,279 4,528 0
Qwen3.5-9B 3.9 7.8 11.1% 1 5.60s 7,913 1,042 0

Быстрое сравнение

Сменить пару сравнения