Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Meituan: LongCat 2.0 vs Qwen: Qwen3.5-35B-A3B

LongCat 2.0 лидирует по среднему баллу: 6.3 vs 6.2. LongCat 2.0 имеет более низкую стоимость benchmark: $0.044 vs $0.837. LongCat 2.0 быстрее: 5.18s vs 112.47s, с долей успешных попыток 36.4% vs 66.7%.

Рекомендуемая модельLongCat 2.0Здесь у него лучший балл (6.3), при этом он примерно в 19.1 раза дешевле, чем Qwen3.5-35B-A3B (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-20

Метрика LongCat 2.0 LongCat 2.0 none Релиз: 2026-07-20 Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium Релиз: 2026-02-24
Оценка 6.3 6.2
Ранг #111 #119
Надежность 10.0 10.0
Стабильность 9.3 7.6
Тестов верно
Доля успешных попыток 36.4% 66.7%
Нестабильные тесты 2 6
Всего запусков 66 66
Стоимость за результат 0.627 9.130
Общая стоимость $0.044 $0.837
Цена входа $0.300 / 1M $0.140 / 1M
Цена выхода $1.200 / 1M $1.000 / 1M
Общее число входных токенов 108,743 130,388
Выходные токены 9,372 40,630
Токены рассуждений 0 786,040
Время ответа (среднее) 5.18s 112.47s
Время ответа (макс.) 48.38s 950.25s
Время ответа (суммарно) 113.95s 2474.28s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 LongCat 2.0

none
Стоимость
$0.027
Время
411.7s
Токены
22,283 tok

#119 Qwen3.5-35B-A3B

medium
Стоимость
$0.009
Время
71.4s
Токены
8,631 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462

Быстрое сравнение

Сменить пару сравнения