AI BENCHY Compare

OpenAI: GPT-5.4 vs Laguna M.1

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-04-29

Метрика	GPT-5.4 GPT-5.4 none Релиз: 2026-03-05	Laguna M.1 Laguna M.1 medium Релиз: 2026-04-28 Бесплатно доступно

Метрика	GPT-5.4 GPT-5.4 none Релиз: 2026-03-05	Laguna M.1 Laguna M.1 medium Релиз: 2026-04-28 Бесплатно доступно
Оценка	5.9	6.3
Ранг	#86	#73
Надежность	Н/Д	10.0
Стабильность	9.1	8.6
Тестов верно
Доля успешных попыток	42.6%	53.7%
Нестабильные тесты	2	3
Всего запусков	54	54
Стоимость за результат	1.477	0.000
Общая стоимость	$0.104	$0.000
???? ?????	$2.500 / 1M	$0.000 / 1M
???? ??????	$15.000 / 1M	$0.000 / 1M
Выходные токены	2,317	63,822
Токены рассуждений	0	0
Время ответа (среднее)	1.51s	13.90s
Время ответа (макс.)	2.95s	53.14s
Время ответа (суммарно)	27.21s	250.28s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	3.2	8.0	8.3%	1		1.21s	406	0
Laguna M.1	6.6	10.0	50.0%	0		9.15s	7,839	0

Программирование	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	10.0	10.0	100.0%	0		2.95s	480	0
Laguna M.1	4.3	1.1	66.7%	1		35.61s	14,327	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	3.0	10.0	0.0%	0		2.89s	291	0
Laguna M.1	3.0	10.0	0.0%	0		53.14s	12,272	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	10.0	10.0	100.0%	0		1.04s	222	0
Laguna M.1	10.0	10.0	100.0%	0		4.93s	2,296	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	5.3	7.2	44.4%	1		1.07s	50	0
Laguna M.1	5.3	7.2	44.4%	1		24.14s	19,020	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	4.4	9.9	0.0%	0		1.78s	184	0
Laguna M.1	4.1	10.0	0.0%	0		6.86s	1,294	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	6.5	10.0	50.0%	0		1.07s	81	0
Laguna M.1	10.0	10.0	100.0%	0		4.30s	1,626	0

Решение головоломок	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	5.6	9.8	33.3%	0		1.52s	357	0
Laguna M.1	3.6	7.2	22.2%	1		6.97s	3,978	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
GPT-5.4	10.0	10.0	100.0%	0		2.75s	246	0
Laguna M.1	10.0	10.0	100.0%	0		6.31s	1,170	0

Быстрое сравнение

Сменить пару сравнения

Laguna M.1mediumБесплатно доступноvsMiMo-V2-Omninone Laguna M.1mediumБесплатно доступноvsGLM 5V Turbonone Laguna M.1mediumБесплатно доступноvsQwen3.5-Flashnone Gemma 4 26B A4BnoneБесплатно доступноvsLaguna M.1mediumБесплатно доступно Seed-2.0-LitenonevsLaguna M.1mediumБесплатно доступно Gemini 2.5 FlashnonevsLaguna M.1mediumБесплатно доступно MiniMax M2.5mediumБесплатно доступноvsGPT-5.4none Laguna M.1mediumБесплатно доступноvsQwen3.5-35B-A3Bnone Mistral Small 4mediumvsGPT-5.4none DeepSeek V4 PrononevsLaguna M.1mediumБесплатно доступно GPT-5.4nonevsLaguna Xs.2mediumБесплатно доступно Laguna M.1mediumБесплатно доступноvsQwen3.6 27Bnone