- Ранг
- #56
- Общее число выходных токенов
- 90,466
- Время ответа (среднее)
- 22.85s
- Общая стоимость
- $1.560
GPT-5.4 (medium) vs Grok 4.5 (medium)
GPT-5.4 (medium) лидирует по среднему баллу: 8.5 vs 8.5. GPT-5.4 (medium) имеет более низкую стоимость benchmark: $1.560 vs $2.042. GPT-5.4 (medium) быстрее: 22.85s vs 68.59s, с долей успешных попыток 77.3% vs 83.3%.
Сравниваемые модели
- Ранг
- #60
- Общее число выходных токенов
- 299,460
- Время ответа (среднее)
- 68.59s
- Общая стоимость
- $2.042
Рекомендуемая модель
GPT-5.4 (medium)
Здесь у него лучший балл (8.5), и он отвечает примерно в 3.0 раза быстрее, чем Grok 4.5 (medium).
Подробное сравнение
| Метрика | GPT-5.4 GPT-5.4 medium | Grok 4.5 Grok 4.5 medium |
|---|---|---|
| Оценка | 8.5 | 8.5 |
| Ранг | #56 | #60 |
| Надежность | 10.0 | 10.0 |
| Стабильность | 8.6 | 8.9 |
| Попытки | 66/66 | 66/66 |
| Тестов верно | ||
| Доля успешных попыток | 77.3% | 83.3% |
| Нестабильные тесты | 4 | 3 |
| Всего запусков | 66 | 66 |
| Стоимость за результат | 10.399 | 12.007 |
| Общая стоимость | $1.560 | $2.042 |
| Цена входа | $2.500 / 1M | $2.000 / 1M |
| Цена выхода | $15.000 / 1M | $6.000 / 1M |
| Общее число входных токенов | 81,136 | 122,155 |
| Выходные токены | 6,155 | 5,514 |
| Токены рассуждений | 84,311 | 293,946 |
| Время ответа (среднее) | 22.85s | 68.59s |
| Время ответа (макс.) | 100.41s | 436.38s |
| Время ответа (суммарно) | 502.78s | 1508.91s |
| Параметры | ~1.5T всего (~100B активных) | ~1.7T всего (~170B активных) |
| Доступность | Закрытая модель | Закрытая модель |
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#56 GPT-5.4
medium- Стоимость
- $0.214
- Время
- 199.6s
- Токены
- 14,349 tok
#60 SpaceXAI: Grok 4.5
medium- Стоимость
- $0.044
- Время
- 59.4s
- Токены
- 7,512 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
Быстрое сравнение
Сменить пару сравнения
DeepSeek V4.1 FlashhighvsGrok 4.5mediumDeepSeek V4.1 FlashlowvsGrok 4.5mediumMuse Spark 1.2lowvsGrok 4.5mediumGPT-5.4mediumvsQwen3.8 MaxlowDeepSeek V4.1 FlashlowvsGPT-5.4mediumDeepSeek V4.1 FlashhighvsGPT-5.4mediumMuse Spark 1.2lowvsGPT-5.4mediumQwen3.8 27BhighvsGrok 4.5mediumGPT-6 SollowvsGrok 4.5mediumQwen3.8 MaxlowvsGrok 4.5mediumInkling SmallhighvsGrok 4.5mediumGrok 4.5mediumvsGLM 5.3 FlashXmax