Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

LongCat 2.0 vs Qwen3.6 27B (medium)

Qwen3.6 27B (medium) лидирует по среднему баллу: 6.5 vs 6.4. LongCat 2.0 имеет более низкую стоимость benchmark: $0.044 vs $1.045. LongCat 2.0 быстрее: 5.17s vs 106.06s, с долей успешных попыток 40.9% vs 60.6%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-15

Ранг
#157
Общее число выходных токенов
9,375
Время ответа (среднее)
5.17s
Общая стоимость
$0.044
Ранг
#150
Общее число выходных токенов
272,573
Время ответа (среднее)
106.06s
Общая стоимость
$1.045
Рекомендуемая модель LongCat 2.0

Его балл близок к лучшему здесь (6.4 против 6.5), при этом он примерно в 23.8 раза дешевле, чем Qwen3.6 27B (medium).

Подробное сравнение

Метрика LongCat 2.0 LongCat 2.0 none Релиз: 2026-07-20 Qwen3.6 27B Qwen3.6 27B medium Релиз: 2026-04-20
Оценка 6.4 6.5
Ранг #157 #150
Надежность 10.0 10.0
Стабильность 9.3 7.6
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 40.9% 60.6%
Нестабильные тесты 2 7
Всего запусков 66 66
Стоимость за результат 0.549 7.448
Общая стоимость $0.044 $1.045
Цена входа $0.300 / 1M $0.600 / 1M
Цена выхода $1.200 / 1M $3.600 / 1M
Общее число входных токенов 108,752 106,176
Выходные токены 9,375 33,013
Токены рассуждений 0 239,560
Время ответа (среднее) 5.17s 106.06s
Время ответа (макс.) 48.38s 1085.11s
Время ответа (суммарно) 113.83s 2333.36s
Параметры 1.6T всего (48B активных) 27B
Доступность Открытый исходный код Открытый исходный код

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#157 LongCat 2.0

none
Стоимость
$0.027
Время
411.7s
Токены
22,283 tok

#150 Qwen3.6 27B

medium
Стоимость
$0.009
Время
39.6s
Токены
3,090 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
Qwen3.6 27B 7.7 10.0 66.7% 0 142.99s 5,051 7,968 43,367

Быстрое сравнение

Сменить пару сравнения