Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MiniMax: MiniMax M3 vs OpenAI: GPT-5.3 Chat

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-01

Метрика MiniMax M3 MiniMax M3 medium Релиз: 2026-06-01 GPT-5.3 Chat GPT-5.3 Chat none Релиз: 2026-03-03
Оценка 7.3 7.4
Ранг #65 #57
Надежность 9.6 10.0
Стабильность 8.4 8.4
Тестов верно
Доля успешных попыток 68.3% 68.3%
Нестабильные тесты 6 4
Всего запусков 60 60
Стоимость за результат 1.083 3.350
Общая стоимость $0.120 $0.402
Цена входа $0.300 / 1M $1.750 / 1M
Цена выхода $1.200 / 1M $14.000 / 1M
Выходные токены 46,884 24,757
Токены рассуждений 85,935 0
Время ответа (среднее) 68.44s 6.13s
Время ответа (макс.) 431.03s 18.33s
Время ответа (суммарно) 1300.32s 122.61s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M3 5.5 3.7 66.7% 3 14.95s 874 3,414
GPT-5.3 Chat 6.7 8.1 58.3% 1 3.86s 3,167 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M3 7.5 10.0 66.7% 1 185.58s 4,071 26,059
GPT-5.3 Chat 6.9 6.2 66.7% 1 10.52s 4,772 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M3 10.0 10.0 100.0% 0 65.30s 1,306 6,253
GPT-5.3 Chat 10.0 10.0 100.0% 0 11.96s 2,614 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M3 10.0 10.0 100.0% 0 14.92s 514 3,164
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.21s 942 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M3 6.0 10.0 44.4% 1 233.13s 16,254 19,070
GPT-5.3 Chat 3.5 4.4 33.3% 2 13.01s 8,264 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M3 5.1 3.4 33.3% 1 33.25s 2,487 2,523
GPT-5.3 Chat 4.6 10.0 0.0% 0 1.99s 319 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M3 9.8 10.0 100.0% 0 6.14s 103 920
GPT-5.3 Chat 9.8 10.0 100.0% 0 3.51s 1,491 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M3 7.9 9.9 66.7% 0 49.91s 11,946 13,761
GPT-5.3 Chat 10.0 10.0 100.0% 0 2.99s 1,758 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M3 10.0 10.0 100.0% 0 11.91s 281 555
GPT-5.3 Chat 10.0 10.0 100.0% 0 8.36s 861 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
MiniMax M3 3.0 10.0 0.0% 0 100.80s 9,048 10,216
GPT-5.3 Chat 3.0 10.0 0.0% 0 4.38s 569 0

Быстрое сравнение

Сменить пару сравнения