- Ранг
- #26
- Общее число выходных токенов
- 88,670
- Время ответа (среднее)
- 23.10s
- Общая стоимость
- $1.533
GPT-5.4 (medium) vs GPT-5.5 (medium)
GPT-5.5 (medium) лидирует по среднему баллу: 9.0 vs 8.5. GPT-5.4 (medium) имеет более низкую стоимость benchmark: $1.533 vs $4.137. GPT-5.4 (medium) быстрее: 23.10s vs 38.42s, с долей успешных попыток 77.3% vs 87.9%.
- Ранг
- #16
- Общее число выходных токенов
- 124,436
- Время ответа (среднее)
- 38.42s
- Общая стоимость
- $4.137
Рекомендуемая модель
GPT-5.4 (medium)
Его балл близок к лучшему здесь (8.5 против 9.0), при этом он примерно в 2.7 раза дешевле, чем GPT-5.5 (medium).
Подробное сравнение
| Метрика | GPT-5.4 GPT-5.4 medium | GPT-5.5 GPT-5.5 medium |
|---|---|---|
| Оценка | 8.5 | 9.0 |
| Ранг | #26 | #16 |
| Надежность | 10.0 | 10.0 |
| Стабильность | 8.6 | 8.9 |
| Тестов верно | ||
| Доля успешных попыток | 77.3% | 87.9% |
| Нестабильные тесты | 4 | 3 |
| Всего запусков | 66 | 66 |
| Стоимость за результат | 10.220 | 22.980 |
| Общая стоимость | $1.533 | $4.137 |
| Цена входа | $2.500 / 1M | $5.000 / 1M |
| Цена выхода | $15.000 / 1M | $30.000 / 1M |
| Общее число входных токенов | 81,127 | 80,659 |
| Выходные токены | 6,155 | 5,617 |
| Токены рассуждений | 82,515 | 118,819 |
| Время ответа (среднее) | 23.10s | 38.42s |
| Время ответа (макс.) | 100.41s | 332.10s |
| Время ответа (суммарно) | 508.26s | 845.35s |
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#26 GPT-5.4
medium- Стоимость
- $0.214
- Время
- 199.6s
- Токены
- 14,349 tok
#16 GPT-5.5
medium- Стоимость
- $0.112
- Время
- 71.9s
- Токены
- 3,807 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
Быстрое сравнение
Сменить пару сравнения
Gemini 3.5 FlashlowvsGPT-5.5mediumGPT-5.5mediumvsGrok 4.5highClaude Opus 5lowvsGPT-5.4mediumGPT-5.4mediumvsGrok 4.5lowGPT-5.4mediumvsInkling SmallhighGemini 3.6 FlashlowvsGPT-5.5mediumGemini 3.5 Flash LitehighvsGPT-5.5mediumClaude Opus 5highvsGPT-5.5mediumMuse Spark 1.1lowvsGPT-5.4mediumGemini 3.5 Flash LitehighvsGPT-5.4mediumDeepSeek V4 Flash 0731lowvsGPT-5.4mediumClaude Opus 5lowvsGPT-5.5medium