Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MiniMax: MiniMax M2.5 vs OpenAI: GPT-5.4

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-03

Метрика MiniMax M2.5 MiniMax M2.5 medium Релиз: 2026-02-12 GPT-5.4 GPT-5.4 none Релиз: 2026-03-05
Оценка 5.5 5.6
Ранг #125 #121
Надежность 10.0 10.0
Стабильность 6.4 9.1
Тестов верно
Доля успешных попыток 48.3% 38.3%
Нестабильные тесты 9 2
Всего запусков 60 60
Стоимость за результат 6.075 1.644
Общая стоимость $0.294 $0.116
Цена входа $0.150 / 1M $2.500 / 1M
Цена выхода $1.150 / 1M $15.000 / 1M
Общее число входных токенов 41,948 31,593
Выходные токены 109,492 2,402
Токены рассуждений 251,674 0
Время ответа (среднее) 49.87s 1.45s
Время ответа (макс.) 237.27s 2.95s
Время ответа (суммарно) 598.39s 29.00s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.5 7.9 6.3 83.3% 2 20.82s 612 286 45,344
GPT-5.4 3.2 8.0 8.3% 1 1.21s 606 406 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.5 3.5 9.8 0.0% 0 125.80s 4,318 354 27,037
GPT-5.4 6.8 10.0 50.0% 0 1.99s 4,686 501 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.5 4.5 2.1 66.7% 1 60.39s 21,104 740 9,713
GPT-5.4 3.0 10.0 0.0% 0 2.89s 11,019 291 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.5 4.6 1.7 66.7% 2 7.48s 6,584 266 3,835
GPT-5.4 10.0 10.0 100.0% 0 1.04s 7,140 222 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.5 2.9 4.4 22.2% 2 237.27s 308 105,047 133,487
GPT-5.4 5.3 7.2 44.4% 1 1.07s 723 50 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.5 3.8 2.5 33.3% 1 6.63s 492 25 1,686
GPT-5.4 4.4 9.9 0.0% 0 1.78s 477 184 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.5 7.5 10.0 50.0% 0 621ms 699 156 1,495
GPT-5.4 6.5 10.0 50.0% 0 1.07s 660 81 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.5 5.3 7.2 44.4% 1 11.21s 495 1,069 9,605
GPT-5.4 5.6 9.8 33.3% 0 1.44s 642 381 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.5 10.0 10.0 100.0% 0 15.35s 7,123 269 937
GPT-5.4 10.0 10.0 100.0% 0 2.75s 5,445 246 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M2.5 3.0 10.0 0.0% 0 80.79s 213 1,280 18,535
GPT-5.4 3.0 10.0 0.0% 0 990ms 195 40 0

Быстрое сравнение

Сменить пару сравнения