Навигация
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Mercury 2.5 (low) vs Laguna S 2.1 (medium)

Mercury 2.5 (low) лидирует по среднему баллу: 5.1 vs 5.0. Mercury 2.5 (low) имеет более низкую стоимость benchmark: $0.020 vs $0.080. Mercury 2.5 (low) быстрее: 3.34s vs 63.06s, с долей успешных попыток 37.7% vs 24.6%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-01

Сравниваемые модели

Ранг
#293
Общее число выходных токенов
40,302
Время ответа (среднее)
3.34s
Общая стоимость
$0.020
Ранг
#296
Общее число выходных токенов
386,824
Время ответа (среднее)
63.06s
Общая стоимость
$0.080
Рекомендуемая модель Mercury 2.5 (low)

Здесь у него лучший балл (5.1), при этом он примерно в 4.2 раза дешевле, чем Laguna S 2.1 (medium).

Подробное сравнение

Метрика Mercury 2.5 Mercury 2.5 low Релиз: 2026-09-08 Laguna S 2.1 Laguna S 2.1 medium Релиз: 2026-07-21 Бесплатно доступно
Оценка 5.1 5.0
Ранг #293 #296
Надежность 9.8 10.0
Стабильность 8.2 8.5
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 37.7% 24.6%
Нестабильные тесты 5 4
Всего запусков 69 69
Стоимость за результат 0.319 1.987
Общая стоимость $0.020 $0.080
Цена входа $0.040 / 1M $0.090 / 1M
Цена выхода $0.150 / 1M $0.180 / 1M
Общее число входных токенов 326,083 230,291
Выходные токены 7,224 99,030
Токены рассуждений 33,078 287,794
Время ответа (среднее) 3.34s 63.06s
Время ответа (макс.) 47.06s 560.31s
Время ответа (суммарно) 76.80s 1450.31s
Параметры ~100B 118B всего (8B активных)
Доступность Закрытая модель Веса доступны

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#293 Mercury 2.5

low
Стоимость
$0.001
Время
2.4s
Токены
1,236 tok

#296 Laguna S 2.1

medium
Стоимость
$0.001
Время
4.0s
Токены
867 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
Mercury 2.5 5.5 10.0 33.3% 0 972ms 7,909 521 2,269
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718

Быстрое сравнение

Сменить пару сравнения