- Ранг
- #37
- Общее число выходных токенов
- 299,460
- Время ответа (среднее)
- 68.59s
- Общая стоимость
- $2.042
Grok 4.5 (medium) vs GLM 5.2 (medium)
Grok 4.5 (medium) лидирует по среднему баллу: 8.5 vs 7.8. GLM 5.2 (medium) имеет более низкую стоимость benchmark: $0.224 vs $2.042. GLM 5.2 (medium) быстрее: 23.28s vs 68.59s, с долей успешных попыток 83.3% vs 80.3%.
- Ранг
- #65
- Общее число выходных токенов
- 61,761
- Время ответа (среднее)
- 23.28s
- Общая стоимость
- $0.224
Рекомендуемая модель
GLM 5.2 (medium)
Его балл близок к лучшему здесь (7.8 против 8.5), при этом он примерно в 9.1 раза дешевле, чем Grok 4.5 (medium).
Подробное сравнение
| Метрика | Grok 4.5 Grok 4.5 medium | GLM 5.2 GLM 5.2 medium |
|---|---|---|
| Оценка | 8.5 | 7.8 |
| Ранг | #37 | #65 |
| Надежность | 10.0 | 9.5 |
| Стабильность | 8.9 | 8.0 |
| Попытки | 66/66 | 63/66 |
| Тестов верно | ||
| Доля успешных попыток | 83.3% | 80.3% |
| Нестабильные тесты | 3 | 4 |
| Всего запусков | 66 | 63 |
| Стоимость за результат | 12.007 | 2.159 |
| Общая стоимость | $2.042 | $0.224 |
| Цена входа | $2.000 / 1M | $0.966 / 1M |
| Цена выхода | $6.000 / 1M | $3.036 / 1M |
| Общее число входных токенов | 122,155 | 37,199 |
| Выходные токены | 5,514 | 12,261 |
| Токены рассуждений | 293,946 | 49,500 |
| Время ответа (среднее) | 68.59s | 23.28s |
| Время ответа (макс.) | 436.38s | 101.36s |
| Время ответа (суммарно) | 1508.91s | 488.94s |
| Параметры | ~1.7T всего (~170B активных) | 744B всего (40B активных) |
| Доступность | Закрытая модель | Открытый исходный код |
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#37 SpaceXAI: Grok 4.5
medium- Стоимость
- $0.044
- Время
- 59.4s
- Токены
- 7,512 tok
#65 GLM 5.2
medium- Стоимость
- $0.041
- Время
- 195.8s
- Токены
- 9,287 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
Быстрое сравнение
Сменить пару сравнения
Muse Spark 1.2lowvsGrok 4.5mediumQwen3.8 27BlowvsGLM 5.2mediumGPT-5.2 ChatnonevsGLM 5.2mediumQwen3.8 27BhighvsGrok 4.5mediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumQwen3.7 FlashhighvsGLM 5.2mediumQwen3.8 MaxlowvsGrok 4.5mediumInkling SmallhighvsGrok 4.5mediumGPT-5.6 TerrahighvsGLM 5.2mediumSeed-2.0-CodelowvsGLM 5.2mediumMuse Spark 1.1lowvsGrok 4.5medium