Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

Mistral: Mistral Small 4 vs OpenAI: GPT-5.4 Nano

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-17

Метрика Mistral Small 4 Mistral Small 4 medium Релиз: 2026-03-16 GPT-5.4 Nano GPT-5.4 Nano none Релиз: 2026-03-17
Ранг #55 #73
Оценка 5.6 4.3
Стабильность 7.0 7.3
Стоимость за результат 0.502 0.404
Общая стоимость $0.026 $0.009
Тестов верно
Доля успешных попыток 49.0% 29.4%
Нестабильные тесты 6 6
Всего запусков 51 51
Выходные токены 12,288 2,185
Токены рассуждений 28,112 0
Время ответа (среднее) 4.18s 1.39s
Время ответа (макс.) 25.25s 3.84s
Время ответа (суммарно) 71.03s 23.70s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Mistral Small 4 5.6 3.8 66.7% 3 2.67s 4,055 4,778
GPT-5.4 Nano 3.5 8.0 16.7% 1 1.18s 800 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Mistral Small 4 3.0 10.0 0.0% 0 25.25s 2,612 10,700
GPT-5.4 Nano 3.0 10.0 0.0% 0 3.84s 280 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Mistral Small 4 7.3 5.9 83.3% 1 1.23s 335 723
GPT-5.4 Nano 6.5 10.0 50.0% 0 1.11s 219 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Mistral Small 4 5.3 7.2 44.4% 1 6.11s 2,621 6,904
GPT-5.4 Nano 2.9 4.4 22.2% 2 926ms 52 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Mistral Small 4 4.8 10.0 0.0% 0 2.05s 821 828
GPT-5.4 Nano 3.8 2.5 33.3% 1 1.31s 180 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Mistral Small 4 7.3 5.8 83.3% 1 1.38s 540 1,031
GPT-5.4 Nano 5.0 6.8 33.3% 1 787ms 84 0
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Mistral Small 4 3.4 9.7 0.0% 0 2.00s 983 2,338
GPT-5.4 Nano 3.7 7.3 22.2% 1 1.29s 348 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
Mistral Small 4 10.0 10.0 100.0% 0 3.50s 321 810
GPT-5.4 Nano 10.0 10.0 100.0% 0 3.40s 222 0

Быстрое сравнение

Сменить пару сравнения