Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mercury 2.5 Preview (medium) vs GPT 5.3 Chat

Средний балл практически равен: 7.5 vs 7.5. Mercury 2.5 Preview (medium) имеет более низкую стоимость benchmark: $0.024 vs $0.533. Mercury 2.5 Preview (medium) быстрее: 3.58s vs 6.56s, с долей успешных попыток 69.7% vs 65.2%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-02

Ранг
#91
Общее число выходных токенов
127,034
Время ответа (среднее)
3.58s
Общая стоимость
$0.024
Ранг
#88
Общее число выходных токенов
28,179
Время ответа (среднее)
6.56s
Общая стоимость
$0.533
Рекомендуемая модель Mercury 2.5 Preview (medium)

Здесь у него лучший балл (7.5), при этом он примерно в 22.6 раза дешевле, чем GPT 5.3 Chat.

Подробное сравнение

Метрика Mercury 2.5 Preview Mercury 2.5 Preview medium Релиз: 2026-09-02 GPT 5.3 Chat GPT 5.3 Chat none Релиз: 2026-03-03
Оценка 7.5 7.5
Ранг #91 #88
Надежность 10.0 10.0
Стабильность 9.6 8.6
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 69.7% 65.2%
Нестабильные тесты 1 4
Всего запусков 66 66
Стоимость за результат 0.158 4.097
Общая стоимость $0.024 $0.533
Цена входа $0.040 / 1M $1.750 / 1M
Цена выхода $0.150 / 1M $14.000 / 1M
Общее число входных токенов 112,713 78,846
Выходные токены 5,436 28,179
Токены рассуждений 121,598 0
Время ответа (среднее) 3.58s 6.56s
Время ответа (макс.) 17.84s 18.33s
Время ответа (суммарно) 78.66s 137.77s
Параметры ~100B ~400B всего (~17B активных)
Доступность Закрытая модель Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 Mercury 2.5 Preview

medium
Стоимость
$0.001
Время
2.7s
Токены
2,241 tok

#88 GPT 5.3 Chat

none
Стоимость
$0.008
Время
8.1s
Токены
634 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Mercury 2.5 Preview 7.8 10.0 66.7% 0 3.86s 7,839 552 22,126
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

Быстрое сравнение

Сменить пару сравнения