Навигация
AI BENCHY
Your ad here

AI BENCHY Compare

OpenAI: GPT-5.4 Nano vs xAI: Grok 4.1 Fast

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-03-17

Метрика GPT-5.4 Nano GPT-5.4 Nano none Релиз: 2026-03-17 Grok 4.1 Fast Grok 4.1 Fast none Релиз: 2025-11-19
Ранг #73 #71
Оценка 4.3 4.4
Стабильность 7.3 9.0
Стоимость за результат 0.404 0.251
Общая стоимость $0.009 $0.008
Тестов верно
Доля успешных попыток 29.4% 23.5%
Нестабильные тесты 6 2
Всего запусков 51 51
Выходные токены 2,185 1,154
Токены рассуждений 0 0
Время ответа (среднее) 1.39s 1.76s
Время ответа (макс.) 3.84s 5.51s
Время ответа (суммарно) 23.70s 17.56s

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Анти-ИИ уловки Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 3.5 8.0 16.7% 1 1.18s 800 0
Grok 4.1 Fast 3.2 10.0 0.0% 0 1.07s 235 0
Комбинированный Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 3.0 10.0 0.0% 0 3.84s 280 0
Grok 4.1 Fast 3.0 10.0 0.0% 0 3.33s 105 0
Парсинг и извлечение данных Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 6.5 10.0 50.0% 0 1.11s 219 0
Grok 4.1 Fast 10.0 10.0 100.0% 0 943ms 180 0
Предметно-ориентированное Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 2.9 4.4 22.2% 2 926ms 52 0
Grok 4.1 Fast 5.9 7.2 55.6% 1 1.06s 15 0
Общий интеллект Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 3.8 2.5 33.3% 1 1.31s 180 0
Grok 4.1 Fast 4.4 9.9 0.0% 0 1.08s 112 0
Следование инструкциям Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 5.0 6.8 33.3% 1 787ms 84 0
Grok 4.1 Fast 3.0 10.0 0.0% 0 923ms 56 0
Puzzle Solving Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 3.7 7.3 22.2% 1 1.29s 348 0
Grok 4.1 Fast 3.2 10.0 0.0% 0 1.28s 243 0
Вызов инструментов Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Выходные токены Токены рассуждений
GPT-5.4 Nano 10.0 10.0 100.0% 0 3.40s 222 0
Grok 4.1 Fast 2.8 1.6 33.3% 1 5.51s 208 0

Быстрое сравнение

Сменить пару сравнения