AI BENCHY Compare

Mistral: Mistral Small 4 vs OpenAI: GPT-5.4 Nano

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-17

Метрика	Mistral Small 4 Mistral Small 4 medium Релиз: 2026-03-16	GPT-5.4 Nano GPT-5.4 Nano none Релиз: 2026-03-17

Метрика	Mistral Small 4 Mistral Small 4 medium Релиз: 2026-03-16	GPT-5.4 Nano GPT-5.4 Nano none Релиз: 2026-03-17
Ранг	#55	#73
Оценка	5.6	4.3
Стабильность	7.0	7.3
Стоимость за результат	0.502	0.404
Общая стоимость	$0.026	$0.009
Тестов верно
Доля успешных попыток	49.0%	29.4%
Нестабильные тесты	6	6
Всего запусков	51	51
Выходные токены	12,288	2,185
Токены рассуждений	28,112	0
Время ответа (среднее)	4.18s	1.39s
Время ответа (макс.)	25.25s	3.84s
Время ответа (суммарно)	71.03s	23.70s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Mistral Small 4	5.6	3.8	66.7%	3		2.67s	4,055	4,778
GPT-5.4 Nano	3.5	8.0	16.7%	1		1.18s	800	0

Комбинированный	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Mistral Small 4	3.0	10.0	0.0%	0		25.25s	2,612	10,700
GPT-5.4 Nano	3.0	10.0	0.0%	0		3.84s	280	0

Парсинг и извлечение данных	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Mistral Small 4	7.3	5.9	83.3%	1		1.23s	335	723
GPT-5.4 Nano	6.5	10.0	50.0%	0		1.11s	219	0

Предметно-ориентированное	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Mistral Small 4	5.3	7.2	44.4%	1		6.11s	2,621	6,904
GPT-5.4 Nano	2.9	4.4	22.2%	2		926ms	52	0

Общий интеллект	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Mistral Small 4	4.8	10.0	0.0%	0		2.05s	821	828
GPT-5.4 Nano	3.8	2.5	33.3%	1		1.31s	180	0

Следование инструкциям	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Mistral Small 4	7.3	5.8	83.3%	1		1.38s	540	1,031
GPT-5.4 Nano	5.0	6.8	33.3%	1		787ms	84	0

Puzzle Solving	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Mistral Small 4	3.4	9.7	0.0%	0		2.00s	983	2,338
GPT-5.4 Nano	3.7	7.3	22.2%	1		1.29s	348	0

Вызов инструментов	Оценка	Стабильность	Доля успешных попыток	Нестабильные тесты	Тестов верно	Время ответа (среднее)	Выходные токены	Токены рассуждений
Mistral Small 4	10.0	10.0	100.0%	0		3.50s	321	810
GPT-5.4 Nano	10.0	10.0	100.0%	0		3.40s	222	0

Быстрое сравнение

Сменить пару сравнения

Mistral Small 4mediumvsGLM 5 Turbonone Mistral Small 4mediumvsGLM 4.7 Flashnone Mistral Small 4mediumvsQwen3.5-27Bnone Mistral Small 4mediumvsGPT-5.4none GPT-5.4 NanononevsQwen3.5-9Bmedium Mistral Small 4mediumvsQwen3.5-122B-A10Bnone Mistral Small 4mediumvsGrok 4.20 Betanone Mistral Small 4mediumvsKimi K2.5none Mistral Small 4mediumvsHunter Alphanone Trinity Large PreviewnoneБесплатно доступноvsMistral Small 4medium Mistral Small 4mediumvsQwen3.5-35B-A3Bnone Gemini 2.5 FlashnonevsMistral Small 4medium