Навигация
AI BENCHY
Advertise here

LongCat 2.0 (medium) vs GLM 5.3 (high)

LongCat 2.0 (medium) лидирует по среднему баллу: 7.4 vs 7.3. GLM 5.3 (high) имеет более низкую стоимость benchmark: $0.403 vs $0.499. GLM 5.3 (high) быстрее: 27.82s vs 143.55s, с долей успешных попыток 59.1% vs 74.2%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-20

Ранг
#94
Общее число выходных токенов
390,873
Время ответа (среднее)
143.55s
Общая стоимость
$0.499
Ранг
#99
Общее число выходных токенов
63,667
Время ответа (среднее)
27.82s
Общая стоимость
$0.403
Рекомендуемая модель GLM 5.3 (high)

Его балл близок к лучшему здесь (7.3 против 7.4), и он отвечает примерно в 5.2 раза быстрее, чем LongCat 2.0 (medium).

Подробное сравнение

Метрика LongCat 2.0 LongCat 2.0 medium Релиз: 2026-07-20 GLM 5.3 GLM 5.3 high Релиз: 2026-08-20
Оценка 7.4 7.3
Ранг #94 #99
Надежность 10.0 10.0
Стабильность 9.3 7.5
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 59.1% 74.2%
Нестабильные тесты 2 7
Всего запусков 66 66
Стоимость за результат 4.153 3.099
Общая стоимость $0.499 $0.403
Цена входа $0.300 / 1M $1.400 / 1M
Цена выхода $1.200 / 1M $4.400 / 1M
Общее число входных токенов 97,324 87,601
Выходные токены 44,383 6,006
Токены рассуждений 346,490 57,661
Время ответа (среднее) 143.55s 27.82s
Время ответа (макс.) 939.52s 159.91s
Время ответа (суммарно) 3158.11s 612.06s
Параметры 1.6T всего (48B активных) 744B всего (40B активных)
Доступность Открытый исходный код Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 LongCat 2.0

medium
Стоимость
$0.016
Время
285.1s
Токены
13,057 tok

#99 GLM 5.3

high
Стоимость
$0.085
Время
362.5s
Токены
19,310 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

Быстрое сравнение

Сменить пару сравнения