Навигация
AI BENCHY
Advertise here

DeepSeek V4 Flash 0423 (high) vs GPT-5.2 (medium)

GPT-5.2 (medium) лидирует по среднему баллу: 8.4 vs 7.6. DeepSeek V4 Flash 0423 (high) имеет более низкую стоимость benchmark: $0.031 vs $1.182. GPT-5.2 (medium) быстрее: 28.51s vs 51.81s, с долей успешных попыток 69.7% vs 72.7%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-15

Ранг
#76
Общее число выходных токенов
211,310
Время ответа (среднее)
51.81s
Общая стоимость
$0.031
Ранг
#41
Общее число выходных токенов
71,252
Время ответа (среднее)
28.51s
Общая стоимость
$1.182
Рекомендуемая модель DeepSeek V4 Flash 0423 (high)

Его балл близок к лучшему здесь (7.6 против 8.4), при этом он примерно в 38.4 раза дешевле, чем GPT-5.2 (medium).

Подробное сравнение

Метрика DeepSeek V4 Flash 0423 DeepSeek V4 Flash 0423 high Релиз: 2026-04-24 GPT-5.2 GPT-5.2 medium Релиз: 2025-12-11
Оценка 7.6 8.4
Ранг #76 #41
Надежность 10.0 10.0
Стабильность 8.5 8.5
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 69.7% 72.7%
Нестабильные тесты 4 4
Всего запусков 66 66
Стоимость за результат 0.446 8.438
Общая стоимость $0.031 $1.182
Цена входа $0.066 / 1M $1.750 / 1M
Цена выхода $0.132 / 1M $14.000 / 1M
Общее число входных токенов 108,480 105,013
Выходные токены 37,229 9,914
Токены рассуждений 174,081 61,338
Время ответа (среднее) 51.81s 28.51s
Время ответа (макс.) 218.13s 116.86s
Время ответа (суммарно) 1139.75s 456.13s
Параметры 284B всего (13B активных) ~1.2T всего (~80B активных)
Доступность Открытый исходный код Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#76 DeepSeek V4 Flash 0423

high
Стоимость
$0.003
Время
93.1s
Токены
7,926 tok

#41 GPT-5.2

medium
Стоимость
$0.047
Время
49.2s
Токены
3,396 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Flash 0423 7.8 10.0 66.7% 0 50.60s 7,279 395 34,862
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912

Быстрое сравнение

Сменить пару сравнения