Навигация
Advertise here

LongCat 2.0 (high) vs Qwen3.8 27B (medium)

LongCat 2.0 (high) лидирует по среднему баллу: 7.3 vs 7.2. Qwen3.8 27B (medium) имеет более низкую стоимость benchmark: ~$0.073 vs $0.569. Qwen3.8 27B (medium) быстрее: 40.09s vs 151.67s, с долей успешных попыток 53.6% vs 66.7%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-10-01

Сравниваемые модели

Ранг
#136
Общее число выходных токенов
404,635
Время ответа (среднее)
151.67s
Общая стоимость
$0.569
Ранг
#141
Общее число выходных токенов
170,696
Время ответа (среднее)
40.09s
Общая стоимость
~$0.073
Рекомендуемая модель Qwen3.8 27B (medium)

Его балл близок к лучшему здесь (7.2 против 7.3), при этом он примерно в 7.8 раза дешевле, чем LongCat 2.0 (high).

Подробное сравнение

Метрика LongCat 2.0 LongCat 2.0 high Релиз: 2026-07-20 Qwen3.8 27B Qwen3.8 27B medium Релиз: 2026-08-14 Бесплатно доступно
Оценка 7.3 7.2
Ранг #136 #141
Надежность 10.0 9.7
Стабильность 8.5 9.4
Попытки 69/69 69/69
Тестов верно
Доля успешных попыток 53.6% 66.7%
Нестабильные тесты 4 2
Всего запусков 69 69
Стоимость за результат 5.681 ~0.520
Общая стоимость $0.569 ~$0.073
Цена входа $0.300 / 1M Н/Д
Цена выхода $1.200 / 1M Н/Д
Общее число входных токенов 275,080 277,164
Выходные токены 32,447 1,913
Токены рассуждений 372,188 168,783
Время ответа (среднее) 151.67s 40.09s
Время ответа (макс.) 941.66s 214.63s
Время ответа (суммарно) 3488.43s 881.89s
Параметры 1.6T всего (48B активных) 27.3B
Доступность Открытый исходный код Веса доступны

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#136 LongCat 2.0

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
Стоимость
$0.000
Время
600.0s
Токены
0 tok

#141 Qwen3.8 27B

medium
Стоимость
~$0.002
Время
43.4s
Токены
2,956 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
LongCat 2.0 7.8 9.3 66.7% 0 505.33s 6,913 244 192,377
Qwen3.8 27B 10.0 10.0 100.0% 0 40.50s 7,893 585 26,808

Быстрое сравнение

Сменить пару сравнения