Навигация
AI BENCHY
Advertise here

LongCat 2.0 (low) vs MiMo-V2.5-Pro (medium)

MiMo-V2.5-Pro (medium) лидирует по среднему баллу: 6.8 vs 6.7. MiMo-V2.5-Pro (medium) имеет более низкую стоимость benchmark: $0.221 vs $0.412. MiMo-V2.5-Pro (medium) быстрее: 48.68s vs 113.61s, с долей успешных попыток 54.6% vs 63.6%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-04

Ранг
#157
Общее число выходных токенов
320,594
Время ответа (среднее)
113.61s
Общая стоимость
$0.412
Ранг
#152
Общее число выходных токенов
185,466
Время ответа (среднее)
48.68s
Общая стоимость
$0.221
Рекомендуемая модель MiMo-V2.5-Pro (medium)

Здесь у него лучший балл (6.8), при этом он примерно в 1.9 раза дешевле, чем LongCat 2.0 (low).

Подробное сравнение

Метрика LongCat 2.0 LongCat 2.0 low Релиз: 2026-07-20 MiMo-V2.5-Pro MiMo-V2.5-Pro medium Релиз: 2026-04-22
Оценка 6.7 6.8
Ранг #157 #152
Надежность 9.9 10.0
Стабильность 8.5 7.9
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 54.6% 63.6%
Нестабильные тесты 4 6
Всего запусков 66 66
Стоимость за результат 4.120 3.790
Общая стоимость $0.412 $0.221
Цена входа $0.300 / 1M $0.435 / 1M
Цена выхода $1.200 / 1M $0.870 / 1M
Общее число входных токенов 90,870 139,892
Выходные токены 5,676 15,569
Токены рассуждений 314,918 169,897
Время ответа (среднее) 113.61s 48.68s
Время ответа (макс.) 560.39s 333.34s
Время ответа (суммарно) 2499.46s 1071.02s
Параметры 1.6T всего (48B активных) 1.02T всего (42B активных)
Доступность Открытый исходный код Открытый исходный код

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#157 LongCat 2.0

low
Стоимость
$0.024
Время
428.0s
Токены
19,557 tok

#152 MiMo-V2.5-Pro

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
Стоимость
$0.000
Время
300.0s
Токены
0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
MiMo-V2.5-Pro 6.2 4.7 66.7% 2 92.07s 6,543 780 51,218

Быстрое сравнение

Сменить пару сравнения