Навигация
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Xiaomi: MiMo-V2.5-Pro

MiMo-V2.5-Pro (medium) лидирует по среднему баллу: 6.9 vs 6.7. MiMo-V2.5-Pro (medium) имеет более низкую стоимость benchmark: $0.187 vs $0.391. MiMo-V2.5-Pro (medium) быстрее: 33.92s vs 100.31s, с долей успешных попыток 53.0% vs 66.7%.

Рекомендуемая модельMiMo-V2.5-Pro (medium)Здесь у него лучший балл (6.9), при этом он примерно в 2.1 раза дешевле, чем LongCat 2.0 (low).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-21

Метрика LongCat 2.0 LongCat 2.0 low Релиз: 2026-07-20 MiMo-V2.5-Pro MiMo-V2.5-Pro medium Релиз: 2026-04-22
Оценка 6.7 6.9
Ранг #96 #88
Надежность 9.6 10.0
Стабильность 8.9 8.2
Тестов верно
Доля успешных попыток 53.0% 66.7%
Нестабильные тесты 3 5
Всего запусков 66 66
Стоимость за результат 3.910 3.218
Общая стоимость $0.391 $0.187
Цена входа $0.300 / 1M $0.435 / 1M
Цена выхода $1.200 / 1M $0.870 / 1M
Общее число входных токенов 90,909 139,883
Выходные токены 5,679 15,521
Токены рассуждений 297,369 130,992
Время ответа (среднее) 100.31s 33.92s
Время ответа (макс.) 560.39s 197.54s
Время ответа (суммарно) 2206.82s 746.19s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 LongCat 2.0

low
Стоимость
$0.024
Время
428.0s
Токены
19,557 tok

#88 MiMo-V2.5-Pro

medium
Неверный SVG
Стоимость
$0.000
Время
300.0s
Токены
0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
MiMo-V2.5-Pro 6.2 4.7 66.7% 2 92.07s 6,543 780 51,218

Быстрое сравнение

Сменить пару сравнения