AI BENCHY Compare

MiniMax: MiniMax M2.5 vs Laguna M.1

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-29

Метрика	MiniMax M2.5 MiniMax M2.5 medium Релиз: 2026-02-12 Бесплатно доступно	Laguna M.1 Laguna M.1 none Релиз: 2026-04-28 Бесплатно доступно

Метрика	MiniMax M2.5 MiniMax M2.5 medium Релиз: 2026-02-12 Бесплатно доступно	Laguna M.1 Laguna M.1 none Релиз: 2026-04-28 Бесплатно доступно
Оценка	5.7	5.1
Ранг	#94	#117
Надежность	Н/Д	9.9
Стабильность	5.6	8.7
Тестов верно
Доля успешных попыток	57.4%	33.3%
Нестабильные тесты	10	3
Всего запусков	54	54
Стоимость за результат	4.987	0.000
Общая стоимость	$0.250	$0.000
???? ?????	$0.150 / 1M	$0.000 / 1M
???? ??????	$1.150 / 1M	$0.000 / 1M
Выходные токены	107,044	2,870
Токены рассуждений	206,422	0
Время ответа (среднее)	39.65s	2.79s
Время ответа (макс.)	237.27s	15.42s
Время ответа (суммарно)	396.47s	50.24s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	7.9	6.3	83.3%	2		20.82s	286	45,344
Laguna M.1	3.4	7.9	16.7%	1		1.23s	485	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	3.0	10.0	0.0%	0		0ms	0	0
Laguna M.1	7.5	3.8	66.7%	1		2.93s	543	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	4.5	2.1	66.7%	1		60.39s	740	9,713
Laguna M.1	3.0	10.0	0.0%	0		4.32s	622	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	4.6	1.7	66.7%	2		7.48s	266	3,835
Laguna M.1	10.0	10.0	100.0%	0		3.37s	246	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	2.9	4.4	22.2%	2		237.27s	105,047	133,487
Laguna M.1	3.6	7.2	22.2%	1		5.50s	33	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	3.8	2.5	33.3%	1		6.63s	25	1,686
Laguna M.1	4.0	10.0	0.0%	0		3.08s	212	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	8.1	6.8	83.3%	1		4.64s	252	1,873
Laguna M.1	6.3	10.0	50.0%	0		683ms	80	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	5.3	7.2	44.4%	1		11.54s	159	9,547
Laguna M.1	3.2	10.0	0.0%	0		951ms	340	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	10.0	10.0	100.0%	0		15.35s	269	937
Laguna M.1	10.0	10.0	100.0%	0		7.54s	309	0

Быстрое сравнение

Сменить пару сравнения

MiniMax M2.5mediumБесплатно доступноvsQwen3.5-122B-A10Bnone MiniMax M2.5mediumБесплатно доступноvsQwen3.6 Flashnone MiniMax M2.5mediumБесплатно доступноvsMiMo-V2.5-Pronone MiniMax M2.5mediumБесплатно доступноvsQwen3.5 Plus 2026-04-20none MiniMax M2.5mediumБесплатно доступноvsGLM 4.7 Flashnone MiniMax M2.5mediumБесплатно доступноvsGLM 5.1none MiniMax M2.5mediumБесплатно доступноvsKimi K2.5none MiniMax M2.5mediumБесплатно доступноvsKimi K2.6none MiniMax M2.5mediumБесплатно доступноvsGLM 5 Turbonone Nemotron 3 Nano Omni 30b A3b ReasoningmediumБесплатно доступноvsLaguna M.1noneБесплатно доступно Elephant AlphamediumvsLaguna M.1noneБесплатно доступно MiniMax M2.5mediumБесплатно доступноvsQwen3.5-27Bnone