Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

MiniMax: MiniMax M2.5 vs OpenAI: GPT-5.4 Nano

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-17

Метрика MiniMax M2.5 MiniMax M2.5 medium Релиз: 2026-02-12 Бесплатно доступно GPT-5.4 Nano GPT-5.4 Nano none Релиз: 2026-03-17
Ранг #50 #73
Оценка 5.9 4.3
Стабильность 5.4 7.3
Стоимость за результат 4.987 0.404
Общая стоимость $0.250 $0.009
Тестов верно
Доля успешных попыток 60.8% 29.4%
Нестабильные тесты 10 6
Всего запусков 51 51
Выходные токены 107,044 2,185
Токены рассуждений 206,422 0
Время ответа (среднее) 39.65s 1.39s
Время ответа (макс.) 237.27s 3.84s
Время ответа (суммарно) 396.47s 23.70s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M2.5 7.9 6.3 83.3% 2 20.82s 286 45,344
GPT-5.4 Nano 3.5 8.0 16.7% 1 1.18s 800 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M2.5 4.5 2.1 66.7% 1 60.39s 740 9,713
GPT-5.4 Nano 3.0 10.0 0.0% 0 3.84s 280 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M2.5 4.6 1.7 66.7% 2 7.48s 266 3,835
GPT-5.4 Nano 6.5 10.0 50.0% 0 1.11s 219 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M2.5 2.9 4.4 22.2% 2 237.27s 105,047 133,487
GPT-5.4 Nano 2.9 4.4 22.2% 2 926ms 52 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M2.5 3.8 2.5 33.3% 1 6.63s 25 1,686
GPT-5.4 Nano 3.8 2.5 33.3% 1 1.31s 180 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M2.5 8.1 6.8 83.3% 1 4.64s 252 1,873
GPT-5.4 Nano 5.0 6.8 33.3% 1 787ms 84 0
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M2.5 5.3 7.2 44.4% 1 11.54s 159 9,547
GPT-5.4 Nano 3.7 7.3 22.2% 1 1.29s 348 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M2.5 10.0 10.0 100.0% 0 15.35s 269 937
GPT-5.4 Nano 10.0 10.0 100.0% 0 3.40s 222 0

Быстрое сравнение

Сменить пару сравнения