- Ранг
- #138
- Общее число выходных токенов
- 404,635
- Время ответа (среднее)
- 151.67s
- Общая стоимость
- $0.778
LongCat 2.0 (high) vs GLM 5 (medium)
LongCat 2.0 (high) лидирует по среднему баллу: 7.3 vs 7.2. GLM 5 (medium) имеет более низкую стоимость benchmark: $0.479 vs $0.778. GLM 5 (medium) быстрее: 39.05s vs 151.67s, с долей успешных попыток 53.6% vs 76.8%.
Сравниваемые модели
- Ранг
- #148
- Общее число выходных токенов
- 138,257
- Время ответа (среднее)
- 39.05s
- Общая стоимость
- $0.479
Рекомендуемая модель
GLM 5 (medium)
Его балл близок к лучшему здесь (7.2 против 7.3), при этом он примерно в 1.6 раза дешевле, чем LongCat 2.0 (high).
Подробное сравнение
| Метрика | LongCat 2.0 LongCat 2.0 high | GLM 5 GLM 5 medium |
|---|---|---|
| Оценка | 7.3 | 7.2 |
| Ранг | #138 | #148 |
| Надежность | 10.0 | 10.0 |
| Стабильность | 8.5 | 7.9 |
| Попытки | 69/69 | 66/69 |
| Тестов верно | ||
| Доля успешных попыток | 53.6% | 76.8% |
| Нестабильные тесты | 4 | 5 |
| Всего запусков | 69 | 66 |
| Стоимость за результат | 5.681 | 2.552 |
| Общая стоимость | $0.778 | $0.479 |
| Цена входа | $0.300 / 1M | $0.600 / 1M |
| Цена выхода | $1.200 / 1M | $1.920 / 1M |
| Цена чтения из кэша | $0.006 / 1M | $0.120 / 1M |
| Цена записи в кэш | Н/Д | Н/Д |
| Общее число входных токенов | 275,080 | 212,440 |
| Выходные токены | 32,447 | 22,922 |
| Токены рассуждений | 372,188 | 115,335 |
| Время ответа (среднее) | 151.67s | 39.05s |
| Время ответа (макс.) | 941.66s | 110.70s |
| Время ответа (суммарно) | 3488.43s | 546.68s |
| Параметры | 1.6T всего (48B активных) | 744B всего (40B активных) |
| Доступность | Открытый исходный код | Открытый исходный код |
Цены кэша относятся к входным токенам. Чтение повторно использует сохранённые запросы; запись сохраняет их и может стоить дороже. Выходные токены оплачиваются по цене вывода.
Генерация showcase моделей
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#138 LongCat 2.0
high
Reached the allocated time limit (600 seconds) without receiving showcase output.
- Стоимость
- $0.000
- Время
- 600.0s
- Токены
- 0 tok
#148 GLM 5
medium- Стоимость
- $0.005
- Время
- 20.7s
- Токены
- 2,068 tok
Лучшие модели по оценке
Оценка vs общая стоимость
Время ответа (среднее)
Оценка vs Время ответа (среднее)
Общее число выходных токенов
Оценка vs Общее число выходных токенов
Разбивка по категориям
| Агентные задачи | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 116.07s | 181,669 | 1,977 | 16,016 | |
| GLM 5 | 4.7 | 3.1 | 33.3% | 1 | 110.70s | 177,216 | 1,352 | 12,339 |
| Анти-ИИ уловки | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 8.9 | 8.1 | 91.7% | 1 | 7.76s | 588 | 303 | 3,300 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 23.66s | 555 | 480 | 7,056 |
| Программирование | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 7.8 | 9.3 | 66.7% | 0 | 505.33s | 6,913 | 244 | 192,377 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 74.30s | 7,254 | 2,997 | 52,930 |
| Комбинированный | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 167.13s | 68,941 | 4,934 | 49,558 | |
| GLM 5 | 5.0 | 5.0 | 50.0% | 0 | 28.96s | 12,804 | 662 | 3,242 |
| Парсинг и извлечение данных | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.6 | 5.8 | 33.3% | 1 | 10.98s | 7,653 | 197 | 2,714 | |
| GLM 5 | 7.1 | 5.6 | 83.3% | 1 | 8.90s | 5,508 | 567 | 3,734 |
| Предметно-ориентированное | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.6 | 7.2 | 22.2% | 1 | 433.73s | 505 | 23,928 | 86,947 | |
| GLM 5 | 3.5 | 4.4 | 33.3% | 2 | 0ms | 260 | 13,176 | 14,137 |
| Общий интеллект | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 5.1 | 10.0 | 0.0% | 0 | 17.00s | 480 | 111 | 1,748 | |
| GLM 5 | 6.1 | 3.1 | 66.7% | 1 | 14.69s | 477 | 2,020 | 2,248 |
| Следование инструкциям | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 6.5 | 10.0 | 50.0% | 0 | 6.96s | 657 | 78 | 1,726 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 7.25s | 636 | 1,001 | 2,129 |
| Решение головоломок | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.1 | 7.4 | 11.1% | 1 | 9.18s | 636 | 379 | 2,778 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 11.33s | 609 | 33 | 4,076 |
| Вызов инструментов | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 10.0 | 10.0 | 100.0% | 0 | 10.02s | 6,840 | 249 | 505 | |
| GLM 5 | 10.0 | 10.0 | 100.0% | 0 | 15.93s | 6,935 | 233 | 994 |
| Эрудиция | Оценка | Стабильность | Доля успешных попыток | Нестабильные тесты | Тестов верно | Время ответа (среднее) | Входные токены | Выходные токены | Токены рассуждений |
|---|---|---|---|---|---|---|---|---|---|
| LongCat 2.0 | 3.0 | 10.0 | 0.0% | 0 | 99.44s | 198 | 47 | 14,519 | |
| GLM 5 | 3.0 | 10.0 | 0.0% | 0 | 67.37s | 186 | 401 | 12,450 |
Быстрое сравнение
Сменить пару сравнения
Gemini 2.5 FlashmediumvsLongCat 2.0highStep 3.7 FlashlowvsGLM 5mediumLongCat 2.0highvsQwen3.6 PlusmediumGemini 3.5 Flash LitemediumvsLongCat 2.0highLongCat 2.0highvsGrok 4.7mediumQwen3.7 FlashhighvsGLM 5mediumClaude Fable 5.1mediumvsLongCat 2.0highClaude Opus 5nonevsGLM 5mediumClaude Opus 4.8lowvsGLM 5mediumGemini 3.8 FlashlowvsGLM 5mediumLongCat 2.0highvsQwen3.5-27BnoneLongCat 2.0highvsQwen3.5 Plus 2026-02-15medium