Навигация
Advertise here

DeepSeek V4 Flash 0731 (medium) vs GPT-6 Luna (high)

DeepSeek V4 Flash 0731 (medium) лидирует по среднему баллу: 7.8 vs 7.7. GPT-6 Luna (high) имеет более низкую стоимость benchmark: $0.074 vs $0.462. GPT-6 Luna (high) быстрее: 20.37s vs 94.16s, с долей успешных попыток 72.5% vs 73.9%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-01

Сравниваемые модели

Ранг
#110
Общее число выходных токенов
577,214
Время ответа (среднее)
94.16s
Общая стоимость
$0.462
Ранг
#111
Общее число выходных токенов
101,587
Время ответа (среднее)
20.37s
Общая стоимость
$0.074
Рекомендуемая модель GPT-6 Luna (high)

Его балл близок к лучшему здесь (7.7 против 7.8), при этом он примерно в 6.3 раза дешевле, чем DeepSeek V4 Flash 0731 (medium).

Подробное сравнение

Метрика DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 medium Релиз: 2026-08-01 GPT-6 Luna GPT-6 Luna high Релиз: 2026-09-23
Оценка 7.8 7.7
Ранг #110 #111
Надежность 10.0 10.0
Стабильность 7.2 8.7
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 72.5% 73.9%
Нестабильные тесты 8 4
Всего запусков 69 69
Стоимость за результат 1.176 0.492
Общая стоимость $0.462 $0.074
Цена входа $0.010 / 1M $0.100 / 1M
Цена выхода $1.280 / 1M $0.500 / 1M
Общее число входных токенов 274,189 229,986
Выходные токены 66,689 6,037
Токены рассуждений 510,525 95,550
Время ответа (среднее) 94.16s 20.37s
Время ответа (макс.) 303.26s 106.93s
Время ответа (суммарно) 2165.72s 468.52s
Параметры 284B всего (13B активных) ~400B всего (~17B активных)
Доступность Закрытая модель Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#110 DeepSeek V4 Flash 0731

medium
Стоимость
$0.004
Время
93.3s
Токены
13,252 tok

#111 GPT-6 Luna

high
Стоимость
$0.003
Время
49.2s
Токены
5,231 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Flash 0731 6.4 4.4 77.8% 2 198.78s 6,032 4,109 160,154
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

Быстрое сравнение

Сменить пару сравнения