Навигация
AI BENCHY
Advertise here

AI BENCHY Compare

MiniMax: MiniMax M3 vs OpenAI: GPT-5.5

Сводка

Сравнение benchmark MiniMax M3 vs GPT-5.5: MiniMax M3 лидирует по среднему баллу: 7.1 vs 6.4. MiniMax M3 имеет более низкую стоимость benchmark: $0.131 vs $0.231. GPT-5.5 быстрее: 1.89s vs 68.17s, с долей успешных попыток 65.1% vs 54.0%.

Рекомендуемая модель: GPT-5.5 - Его балл близок к лучшему здесь (6.4 против 7.1), и он отвечает примерно в 36.1 раза быстрее, чем MiniMax M3.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-06-04

Метрика MiniMax M3 MiniMax M3 medium Релиз: 2026-06-01 GPT-5.5 GPT-5.5 none Релиз: 2026-04-24
Оценка 7.1 6.4
Ранг #67 #91
Надежность 9.6 10.0
Стабильность 7.9 8.8
Тестов верно
Доля успешных попыток 65.1% 54.0%
Нестабильные тесты 5 3
Всего запусков 63 63
Стоимость за результат 1.187 2.302
Общая стоимость $0.131 $0.231
Цена входа $0.300 / 1M $5.000 / 1M
Цена выхода $1.200 / 1M $30.000 / 1M
Общее число входных токенов 46,546 34,212
Выходные токены 49,036 1,971
Токены рассуждений 92,543 0
Время ответа (среднее) 68.17s 1.89s
Время ответа (макс.) 431.03s 5.56s
Время ответа (суммарно) 1363.38s 39.64s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 MiniMax M3

medium
Cost
$0.012
Time
154.4s
Tokens
10,018 tok

#91 GPT-5.5

none
Cost
$0.090
Time
54.3s
Tokens
3,063 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M3 5.5 3.7 66.7% 3 14.95s 2,526 874 3,414
GPT-5.5 6.9 7.9 66.7% 1 1.31s 606 213 0
Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M3 6.1 6.5 55.6% 1 144.74s 5,804 6,223 32,667
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M3 10.0 10.0 100.0% 0 65.30s 14,760 1,306 6,253
GPT-5.5 3.0 10.0 0.0% 0 5.56s 11,019 300 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M3 10.0 10.0 100.0% 0 14.92s 8,088 514 3,164
GPT-5.5 10.0 10.0 100.0% 0 1.18s 7,140 222 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M3 5.5 9.3 33.3% 0 233.13s 869 16,254 19,070
GPT-5.5 2.9 7.2 11.1% 1 1.31s 723 52 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M3 5.1 3.4 33.3% 1 33.25s 954 2,487 2,523
GPT-5.5 10.0 10.0 100.0% 0 3.41s 477 124 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M3 9.8 10.0 100.0% 0 6.14s 1,623 103 920
GPT-5.5 6.2 5.8 66.7% 1 1.15s 660 81 0
Решение головоломок Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M3 7.9 9.9 66.7% 0 49.91s 2,079 11,946 13,761
GPT-5.5 7.7 10.0 66.7% 0 1.29s 642 252 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M3 10.0 10.0 100.0% 0 11.91s 9,168 281 555
GPT-5.5 10.0 10.0 100.0% 0 3.90s 5,445 247 0
Эрудиция Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
MiniMax M3 3.0 10.0 0.0% 0 100.80s 675 9,048 10,216
GPT-5.5 3.0 10.0 0.0% 0 5.01s 195 18 0

Быстрое сравнение

Сменить пару сравнения