Навигация
Advertise here

LongCat 2.0 (high) vs Grok 4.7 (medium)

Средний балл практически равен: 7.3 vs 7.3. LongCat 2.0 (high) имеет более низкую стоимость benchmark: $0.569 vs $3.501. Grok 4.7 (medium) быстрее: 117.65s vs 151.67s, с долей успешных попыток 53.6% vs 78.3%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-01

Сравниваемые модели

Ранг
#136
Общее число выходных токенов
404,635
Время ответа (среднее)
151.67s
Общая стоимость
$0.569
Ранг
#134
Общее число выходных токенов
474,745
Время ответа (среднее)
117.65s
Общая стоимость
$3.501
Рекомендуемая модель LongCat 2.0 (high)

Здесь у него лучший балл (7.3), при этом он примерно в 6.2 раза дешевле, чем Grok 4.7 (medium).

Подробное сравнение

Метрика LongCat 2.0 LongCat 2.0 high Релиз: 2026-07-20 Grok 4.7 Grok 4.7 medium Релиз: 2026-09-21
Оценка 7.3 7.3
Ранг #136 #134
Надежность 10.0 9.8
Стабильность 8.5 8.3
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 53.6% 78.3%
Нестабильные тесты 4 5
Всего запусков 69 69
Стоимость за результат 5.681 19.582
Общая стоимость $0.569 $3.501
Цена входа $0.300 / 1M $2.000 / 1M
Цена выхода $1.200 / 1M $6.000 / 1M
Общее число входных токенов 275,080 326,066
Выходные токены 32,447 5,726
Токены рассуждений 372,188 469,019
Время ответа (среднее) 151.67s 117.65s
Время ответа (макс.) 941.66s 660.89s
Время ответа (суммарно) 3488.43s 2706.03s
Параметры 1.6T всего (48B активных) ~1.7T всего (~170B активных)
Доступность Открытый исходный код Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#136 LongCat 2.0

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
Стоимость
$0.000
Время
600.0s
Токены
0 tok

#134 SpaceXAI: Grok 4.7

medium
Стоимость
$0.047
Время
132.3s
Токены
9,954 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
LongCat 2.0 7.8 9.3 66.7% 0 505.33s 6,913 244 192,377
Grok 4.7 6.6 4.6 77.8% 2 312.17s 10,266 349 172,347

Быстрое сравнение

Сменить пару сравнения