Навигация
Advertise here

DeepSeek V4.1 Flash (medium) vs GPT-5.2 (medium)

DeepSeek V4.1 Flash (medium) лидирует по среднему баллу: 8.5 vs 8.4. DeepSeek V4.1 Flash (medium) имеет более низкую стоимость benchmark: $0.272 vs $1.182. GPT-5.2 (medium) быстрее: 28.51s vs 32.22s, с долей успешных попыток 72.7% vs 72.7%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-10

Сравниваемые модели

Ранг
#53
Общее число выходных токенов
430,816
Время ответа (среднее)
32.22s
Общая стоимость
$0.272
Ранг
#58
Общее число выходных токенов
71,252
Время ответа (среднее)
28.51s
Общая стоимость
$1.182
Рекомендуемая модель DeepSeek V4.1 Flash (medium)

Здесь у него лучший балл (8.5), при этом он примерно в 4.3 раза дешевле, чем GPT-5.2 (medium).

Подробное сравнение

Метрика DeepSeek V4.1 Flash DeepSeek V4.1 Flash medium Релиз: 2026-09-10 GPT-5.2 GPT-5.2 medium Релиз: 2025-12-11
Оценка 8.5 8.4
Ранг #53 #58
Надежность 9.5 10.0
Стабильность 9.3 8.5
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 72.7% 72.7%
Нестабильные тесты 2 4
Всего запусков 66 66
Стоимость за результат 1.812 8.438
Общая стоимость $0.272 $1.182
Цена входа $0.150 / 1M $1.750 / 1M
Цена выхода $0.600 / 1M $14.000 / 1M
Общее число входных токенов 88,508 105,013
Выходные токены 5,410 9,914
Токены рассуждений 425,406 61,338
Время ответа (среднее) 32.22s 28.51s
Время ответа (макс.) 276.31s 116.86s
Время ответа (суммарно) 708.76s 456.13s
Параметры 748B всего (16B активных) ~1.2T всего (~80B активных)
Доступность Открытый исходный код Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#53 DeepSeek V4.1 Flash

medium
Стоимость
$0.014
Время
34.7s
Токены
11,541 tok

#58 GPT-5.2

medium
Стоимость
$0.047
Время
49.2s
Токены
3,396 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4.1 Flash 10.0 10.0 100.0% 0 34.45s 7,509 396 71,345
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912

Быстрое сравнение

Сменить пару сравнения