Навигация
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mercury 2.5 (high) vs GPT-6 Luna (low)

Средний балл практически равен: 7.1 vs 7.0. GPT-6 Luna (low) имеет более низкую стоимость benchmark: $0.020 vs $0.031. Mercury 2.5 (high) быстрее: 4.32s vs 21.96s, с долей успешных попыток 62.1% vs 62.1%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-23

Сравниваемые модели

Ранг
#156
Общее число выходных токенов
174,547
Время ответа (среднее)
4.32s
Общая стоимость
$0.031
Ранг
#159
Общее число выходных токенов
22,605
Время ответа (среднее)
21.96s
Общая стоимость
$0.020
Рекомендуемая модель Mercury 2.5 (high)

Здесь у него лучший балл (7.1), и он отвечает примерно в 5.1 раза быстрее, чем GPT-6 Luna (low).

Подробное сравнение

Метрика Mercury 2.5 Mercury 2.5 high Релиз: 2026-09-08 GPT-6 Luna GPT-6 Luna low Релиз: 2026-09-23
Оценка 7.1 7.0
Ранг #156 #159
Надежность 9.7 9.6
Стабильность 8.6 8.5
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 62.1% 62.1%
Нестабильные тесты 4 4
Всего запусков 66 66
Стоимость за результат 0.259 0.176
Общая стоимость $0.031 $0.020
Цена входа $0.040 / 1M $0.100 / 1M
Цена выхода $0.150 / 1M $0.500 / 1M
Общее число входных токенов 120,068 80,159
Выходные токены 3,402 4,623
Токены рассуждений 171,145 17,982
Время ответа (среднее) 4.32s 21.96s
Время ответа (макс.) 23.63s 89.37s
Время ответа (суммарно) 95.06s 483.19s
Параметры ~100B ~400B всего (~17B активных)
Доступность Закрытая модель Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#156 Mercury 2.5

high
Стоимость
$0.001
Время
3.5s
Токены
2,447 tok

#159 GPT-6 Luna

low
Стоимость
$0.002
Время
19.2s
Токены
2,598 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Mercury 2.5 6.4 7.8 44.4% 1 6.58s 7,757 415 44,012
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

Быстрое сравнение

Сменить пару сравнения