AI BENCHY Compare

MiniMax: MiniMax M2.5 vs GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-02

Метрика	MiniMax M2.5 MiniMax M2.5 medium Релиз: 2026-02-12 Бесплатно доступно	GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT none Релиз: Дата релиза неизвестна

Метрика	MiniMax M2.5 MiniMax M2.5 medium Релиз: 2026-02-12 Бесплатно доступно	GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT none Релиз: Дата релиза неизвестна
Оценка	5.9	3.0
Ранг	#60	#88
Стабильность	5.4	10.0
Тестов верно
Доля успешных попыток	60.8%	0.0%
Нестабильные тесты	10	0
Всего запусков	51	48
Стоимость за результат	4.987	0.000
Общая стоимость	$0.250	$0.000
???? ?????	$0.118 / 1M	$0.000 / 1M
???? ??????	$1.000 / 1M	$0.000 / 1M
Выходные токены	107,044	0
Токены рассуждений	206,422	0
Время ответа (среднее)	39.65s	0ms
Время ответа (макс.)	237.27s	0ms
Время ответа (суммарно)	396.47s	0ms

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	7.9	6.3	83.3%	2		20.82s	286	45,344
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	4.5	2.1	66.7%	1		60.39s	740	9,713
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	4.6	1.7	66.7%	2		7.48s	266	3,835
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	2.9	4.4	22.2%	2		237.27s	105,047	133,487
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	3.8	2.5	33.3%	1		6.63s	25	1,686
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	8.1	6.8	83.3%	1		4.64s	252	1,873
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Puzzle Solving	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	5.3	7.2	44.4%	1		11.54s	159	9,547
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	10.0	10.0	100.0%	0		15.35s	269	937
GLM 5v Turbo X Ai/grok 4.20 Google/gemma 4 31b IT	3.0	10.0	0.0%	0		0ms	0	0

Быстрое сравнение

Сменить пару сравнения

MiniMax M2.5mediumБесплатно доступноvsQwen3.5-35B-A3Bnone MiniMax M2.5mediumБесплатно доступноvsHunter Alphanone Gemini 2.5 FlashnonevsMiniMax M2.5mediumБесплатно доступно MiniMax M2.5mediumБесплатно доступноvsQwen3.5-122B-A10Bnone Seed-2.0-LitenonevsMiniMax M2.5mediumБесплатно доступно MiniMax M2.5mediumБесплатно доступноvsGLM 5V Turbonone MiniMax M2.5mediumБесплатно доступноvsMiMo-V2-Pronone MiniMax M2.5mediumБесплатно доступноvsQwen3.5-Flashnone MiniMax M2.5mediumБесплатно доступноvsGPT-5.4none MiniMax M2.5mediumБесплатно доступноvsQwen3.5-27Bnone MiniMax M2.5mediumБесплатно доступноvsGLM 5 Turbonone MiniMax M2.5mediumБесплатно доступноvsGLM 4.7 Flashnone