Навигация
Advertise here

DeepSeek V3.2 (medium) vs Mercury 2.5 (high)

Mercury 2.5 (high) лидирует по среднему баллу: 7.1 vs 7.0. Mercury 2.5 (high) имеет более низкую стоимость benchmark: $0.031 vs $0.078. Mercury 2.5 (high) быстрее: 4.32s vs 68.43s, с долей успешных попыток 65.2% vs 62.1%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-08

Сравниваемые модели

Ранг
#137
Общее число выходных токенов
128,787
Время ответа (среднее)
68.43s
Общая стоимость
$0.078
Ранг
#134
Общее число выходных токенов
174,547
Время ответа (среднее)
4.32s
Общая стоимость
$0.031
Рекомендуемая модель Mercury 2.5 (high)

Здесь у него лучший балл (7.1), при этом он примерно в 2.5 раза дешевле, чем DeepSeek V3.2 (medium).

Подробное сравнение

Метрика DeepSeek V3.2 DeepSeek V3.2 medium Релиз: 2025-12-01 Mercury 2.5 Mercury 2.5 high Релиз: 2026-09-08
Оценка 7.0 7.1
Ранг #137 #134
Надежность 10.0 9.7
Стабильность 7.4 8.6
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 65.2% 62.1%
Нестабильные тесты 7 4
Всего запусков 66 66
Стоимость за результат 0.672 0.259
Общая стоимость $0.078 $0.031
Цена входа $0.269 / 1M $0.040 / 1M
Цена выхода $0.400 / 1M $0.150 / 1M
Общее число входных токенов 101,056 120,068
Выходные токены 11,832 3,402
Токены рассуждений 116,955 171,145
Время ответа (среднее) 68.43s 4.32s
Время ответа (макс.) 376.10s 23.63s
Время ответа (суммарно) 1505.53s 95.06s
Параметры 671B всего (37B активных) ~100B
Доступность Открытый исходный код Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#137 DeepSeek V3.2

medium
Стоимость
$0.001
Время
53.6s
Токены
1,932 tok

#134 Mercury 2.5

high
Стоимость
$0.001
Время
3.5s
Токены
2,447 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
DeepSeek V3.2 6.0 7.2 55.6% 1 248.68s 5,717 649 52,014
Mercury 2.5 6.4 7.8 44.4% 1 6.58s 7,757 415 44,012

Быстрое сравнение

Сменить пару сравнения