AI BENCHY Compare

MiniMax: MiniMax M2.7 vs Laguna M.1

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-29

Метрика	MiniMax M2.7 MiniMax M2.7 medium Релиз: 2026-03-18	Laguna M.1 Laguna M.1 none Релиз: 2026-04-28 Бесплатно доступно

Метрика	MiniMax M2.7 MiniMax M2.7 medium Релиз: 2026-03-18	Laguna M.1 Laguna M.1 none Релиз: 2026-04-28 Бесплатно доступно
Оценка	5.3	5.1
Ранг	#105	#117
Надежность	Н/Д	9.9
Стабильность	5.5	8.7
Тестов верно
Доля успешных попыток	51.9%	33.3%
Нестабильные тесты	10	3
Всего запусков	54	54
Стоимость за результат	2.273	0.000
Общая стоимость	$0.091	$0.000
???? ?????	$0.300 / 1M	$0.000 / 1M
???? ??????	$1.200 / 1M	$0.000 / 1M
Выходные токены	4,984	2,870
Токены рассуждений	62,787	0
Время ответа (среднее)	31.08s	2.79s
Время ответа (макс.)	117.04s	15.42s
Время ответа (суммарно)	528.37s	50.24s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.7	7.9	6.3	83.3%	2		40.32s	3,010	17,716
Laguna M.1	3.4	7.9	16.7%	1		1.23s	485	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.7	10.0	10.0	100.0%	0		91.27s	467	15,175
Laguna M.1	7.5	3.8	66.7%	1		2.93s	543	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.7	4.7	1.6	66.7%	1		41.03s	369	4,480
Laguna M.1	3.0	10.0	0.0%	0		4.32s	622	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.7	6.3	5.8	66.7%	1		21.95s	187	5,882
Laguna M.1	10.0	10.0	100.0%	0		3.37s	246	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.7	3.0	10.0	0.0%	0		19.00s	8	2,796
Laguna M.1	3.6	7.2	22.2%	1		5.50s	33	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.7	3.9	2.5	33.3%	1		38.70s	92	5,204
Laguna M.1	4.0	10.0	0.0%	0		3.08s	212	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.7	3.7	1.8	50.0%	2		12.64s	213	2,457
Laguna M.1	6.3	10.0	50.0%	0		683ms	80	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.7	3.8	4.5	33.3%	2		25.62s	334	8,076
Laguna M.1	3.2	10.0	0.0%	0		951ms	340	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.7	4.7	1.6	66.7%	1		12.05s	304	1,001
Laguna M.1	10.0	10.0	100.0%	0		7.54s	309	0

Быстрое сравнение

Сменить пару сравнения

DeepSeek V4 FlashnonevsMiniMax M2.7medium MiniMax M2.7mediumvsGrok 4.20none MiniMax M2.7mediumvsMistral Small 4none Trinity Large PreviewnonevsMiniMax M2.7medium MiniMax M2.7mediumvsgpt-oss-120bnoneБесплатно доступно Ling-2.6-flashnoneБесплатно доступноvsMiniMax M2.7medium MiniMax M2.7mediumvsElephant Alphanone MiniMax M2.7mediumvsGPT-5.4 Mininone MiniMax M2.7mediumvsQwen3 Coder Nextnone Nemotron 3 Nano Omni 30b A3b ReasoningmediumБесплатно доступноvsLaguna M.1noneБесплатно доступно MiniMax M2.7mediumvsMiMo-V2.5none MiniMax M2.7mediumvsQwen3.6 35B A3Bnone