AI BENCHY Compare

MiniMax: MiniMax M2.5 vs OpenAI: gpt-oss-120b

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-11

Метрика	MiniMax M2.5 MiniMax M2.5 medium Релиз: 2026-02-12 Бесплатно доступно	gpt-oss-120b gpt-oss-120b none Релиз: 2025-08-05 Бесплатно доступно

Метрика	MiniMax M2.5 MiniMax M2.5 medium Релиз: 2026-02-12 Бесплатно доступно	gpt-oss-120b gpt-oss-120b none Релиз: 2025-08-05 Бесплатно доступно
Оценка	5.7	5.2
Ранг	#67	#79
Стабильность	5.6	7.9
Тестов верно
Доля успешных попыток	57.4%	38.9%
Нестабильные тесты	10	5
Всего запусков	54	54
Стоимость за результат	4.987	0.221
Общая стоимость	$0.250	$0.009
???? ?????	$0.118 / 1M	$0.039 / 1M
???? ??????	$0.991 / 1M	$0.190 / 1M
Выходные токены	107,044	44,652
Токены рассуждений	206,422	0
Время ответа (среднее)	39.65s	11.96s
Время ответа (макс.)	237.27s	68.97s
Время ответа (суммарно)	396.47s	179.34s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	7.9	6.3	83.3%	2		20.82s	286	45,344
gpt-oss-120b	6.6	8.0	58.3%	1		6.03s	4,867	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	3.0	10.0	0.0%	0		0ms	0	0
gpt-oss-120b	4.3	1.1	66.7%	1		9.57s	3,232	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	4.5	2.1	66.7%	1		60.39s	740	9,713
gpt-oss-120b	3.0	10.0	0.0%	0		0ms	0	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	4.6	1.7	66.7%	2		7.48s	266	3,835
gpt-oss-120b	6.5	10.0	50.0%	0		7.12s	598	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	2.9	4.4	22.2%	2		237.27s	105,047	133,487
gpt-oss-120b	3.0	10.0	0.0%	0		34.98s	29,483	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	3.8	2.5	33.3%	1		6.63s	25	1,686
gpt-oss-120b	4.6	10.0	0.0%	0		2.83s	586	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	8.1	6.8	83.3%	1		4.64s	252	1,873
gpt-oss-120b	8.4	6.9	83.3%	1		5.10s	1,982	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	5.3	7.2	44.4%	1		11.54s	159	9,547
gpt-oss-120b	4.5	4.8	44.5%	2		6.86s	3,904	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
MiniMax M2.5	10.0	10.0	100.0%	0		15.35s	269	937
gpt-oss-120b	3.0	10.0	0.0%	0		0ms	0	0

Быстрое сравнение

Сменить пару сравнения

MiniMax M2.5mediumБесплатно доступноvsQwen3.5-122B-A10Bnone MiniMax M2.7mediumvsgpt-oss-120bnoneБесплатно доступно MiniMax M2.5mediumБесплатно доступноvsGLM 4.7 Flashnone MiniMax M2.5mediumБесплатно доступноvsGLM 5.1none MiniMax M2.5mediumБесплатно доступноvsKimi K2.5none MiniMax M2.5mediumБесплатно доступноvsGLM 5 Turbonone MiniMax M2.5mediumБесплатно доступноvsQwen3.5-27Bnone MiniMax M2.5mediumБесплатно доступноvsGPT-5.4none MiniMax M2.5mediumБесплатно доступноvsMiMo-V2-Pronone Trinity Large PreviewnoneБесплатно доступноvsMiniMax M2.5mediumБесплатно доступно DeepSeek V3.2nonevsMiniMax M2.5mediumБесплатно доступно MiniMax M2.5mediumБесплатно доступноvsQwen3.5-35B-A3Bnone