Навигация
Advertise here

DeepSeek V4 Pro vs Mercury 2.5 (medium)

Средний балл практически равен: 6.8 vs 6.8. Mercury 2.5 (medium) имеет более низкую стоимость benchmark: $0.022 vs $0.208. Mercury 2.5 (medium) быстрее: 3.19s vs 11.71s, с долей успешных попыток 47.0% vs 65.2%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-08

Сравниваемые модели

Ранг
#154
Общее число выходных токенов
35,547
Время ответа (среднее)
11.71s
Общая стоимость
$0.208
Ранг
#157
Общее число выходных токенов
120,129
Время ответа (среднее)
3.19s
Общая стоимость
$0.022
Рекомендуемая модель Mercury 2.5 (medium)

Здесь у него лучший балл (6.8), при этом он примерно в 9.6 раза дешевле, чем DeepSeek V4 Pro.

Подробное сравнение

Метрика DeepSeek V4 Pro DeepSeek V4 Pro none Релиз: 2026-04-24 Mercury 2.5 Mercury 2.5 medium Релиз: 2026-09-08
Оценка 6.8 6.8
Ранг #154 #157
Надежность 10.0 9.8
Стабильность 8.6 8.6
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 47.0% 65.2%
Нестабильные тесты 4 4
Всего запусков 66 66
Стоимость за результат 1.061 0.181
Общая стоимость $0.208 $0.022
Цена входа $0.947 / 1M $0.040 / 1M
Цена выхода $1.893 / 1M $0.150 / 1M
Общее число входных токенов 148,078 91,402
Выходные токены 35,547 3,138
Токены рассуждений 0 116,991
Время ответа (среднее) 11.71s 3.19s
Время ответа (макс.) 119.44s 9.87s
Время ответа (суммарно) 257.67s 70.18s
Параметры 1.6T всего (49B активных) ~100B
Доступность Открытый исходный код Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#154 DeepSeek V4 Pro

none
Reached the allocated time limit (300 seconds) without receiving showcase output.
Стоимость
$0.000
Время
300.0s
Токены
0 tok

#157 Mercury 2.5

medium
Стоимость
$0.001
Время
3.8s
Токены
3,386 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V4 Pro 5.6 10.0 33.3% 0 13.38s 7,275 5,500 0
Mercury 2.5 5.0 5.1 44.5% 2 3.70s 7,807 488 21,857

Быстрое сравнение

Сменить пару сравнения