Навигация
Advertise here

Mercury 2.5 Preview (medium) vs GPT-5.6 Luna (low)

Средний балл практически равен: 6.8 vs 6.9. Mercury 2.5 Preview (medium) имеет более низкую стоимость benchmark: $0.037 vs $0.075. Mercury 2.5 Preview (medium) быстрее: 6.66s vs 6.96s, с долей успешных попыток 66.7% vs 56.5%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-01

Сравниваемые модели

Ранг
#171
Общее число выходных токенов
150,107
Время ответа (среднее)
6.66s
Общая стоимость
$0.037
Ранг
#165
Общее число выходных токенов
28,001
Время ответа (среднее)
6.96s
Общая стоимость
$0.075
Рекомендуемая модель Mercury 2.5 Preview (medium)

Здесь у него лучший балл (6.8), при этом он примерно в 2.0 раза дешевле, чем GPT-5.6 Luna (low).

Подробное сравнение

Метрика Mercury 2.5 Preview Mercury 2.5 Preview medium Релиз: 2026-09-02 GPT-5.6 Luna GPT-5.6 Luna low Релиз: 2026-07-09
Оценка 6.8 6.9
Ранг #171 #165
Надежность 10.0 10.0
Стабильность 9.6 8.3
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 66.7% 56.5%
Нестабильные тесты 1 5
Всего запусков 69 69
Стоимость за результат 0.244 2.428
Общая стоимость $0.037 $0.075
Цена входа $0.000 / 1M $0.200 / 1M
Цена выхода $0.000 / 1M $1.200 / 1M
Общее число входных токенов 397,291 202,680
Выходные токены 6,355 9,230
Токены рассуждений 143,752 18,771
Время ответа (среднее) 6.66s 6.96s
Время ответа (макс.) 74.63s 45.74s
Время ответа (суммарно) 153.29s 160.19s
Параметры ~100B ~400B всего (~17B активных)
Доступность Закрытая модель Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#171 Mercury 2.5 Preview

medium
Стоимость
$0.001
Время
2.7s
Токены
2,241 tok

#165 GPT-5.6 Luna

low
Стоимость
$0.011
Время
10.2s
Токены
1,897 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Mercury 2.5 Preview 7.8 10.0 66.7% 0 3.86s 7,839 552 22,126
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

Быстрое сравнение

Сменить пару сравнения