Навигация
Advertise here

LongCat 2.0 (high) vs Qwen3.6 Plus (medium)

Средний балл практически равен: 7.3 vs 7.3. Qwen3.6 Plus (medium) имеет более низкую стоимость benchmark: $0.391 vs $0.569. Qwen3.6 Plus (medium) быстрее: 57.41s vs 151.67s, с долей успешных попыток 53.6% vs 69.6%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-01

Сравниваемые модели

Ранг
#136
Общее число выходных токенов
404,635
Время ответа (среднее)
151.67s
Общая стоимость
$0.569
Ранг
#137
Общее число выходных токенов
246,790
Время ответа (среднее)
57.41s
Общая стоимость
$0.391
Рекомендуемая модель Qwen3.6 Plus (medium)

Здесь у него лучший балл (7.3), и он отвечает примерно в 2.6 раза быстрее, чем LongCat 2.0 (high).

Подробное сравнение

Метрика LongCat 2.0 LongCat 2.0 high Релиз: 2026-07-20 Qwen3.6 Plus Qwen3.6 Plus medium Релиз: 2026-04-20
Оценка 7.3 7.3
Ранг #136 #137
Надежность 10.0 10.0
Стабильность 8.5 9.0
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 53.6% 69.6%
Нестабильные тесты 4 3
Всего запусков 69 69
Стоимость за результат 5.681 2.605
Общая стоимость $0.569 $0.391
Цена входа $0.300 / 1M $0.325 / 1M
Цена выхода $1.200 / 1M $1.950 / 1M
Общее число входных токенов 275,080 222,601
Выходные токены 32,447 8,185
Токены рассуждений 372,188 238,605
Время ответа (среднее) 151.67s 57.41s
Время ответа (макс.) 941.66s 307.08s
Время ответа (суммарно) 3488.43s 1263.02s
Параметры 1.6T всего (48B активных) ~397B всего (~17B активных)
Доступность Открытый исходный код Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#136 LongCat 2.0

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
Стоимость
$0.000
Время
600.0s
Токены
0 tok

#137 Qwen3.6 Plus

medium
Стоимость
$0.024
Время
219.0s
Токены
12,235 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
LongCat 2.0 7.8 9.3 66.7% 0 505.33s 6,913 244 192,377
Qwen3.6 Plus 6.1 7.8 44.4% 1 153.12s 7,098 58 50,586

Быстрое сравнение

Сменить пару сравнения