Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Meituan: LongCat 2.0 vs Qwen: Qwen3.5 Plus 2026-02-15

Qwen3.5 Plus 2026-02-15 лидирует по среднему баллу: 6.4 vs 6.3. LongCat 2.0 имеет более низкую стоимость benchmark: $0.044 vs $0.073. LongCat 2.0 быстрее: 5.18s vs 9.85s, с долей успешных попыток 36.4% vs 48.5%.

Рекомендуемая модельLongCat 2.0Его балл близок к лучшему здесь (6.3 против 6.4), при этом он примерно в 1.7 раза дешевле, чем Qwen3.5 Plus 2026-02-15.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-20

Метрика LongCat 2.0 LongCat 2.0 none Релиз: 2026-07-20 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 none Релиз: 2026-02-15
Оценка 6.3 6.4
Ранг #111 #107
Надежность 10.0 10.0
Стабильность 9.3 9.4
Тестов верно
Доля успешных попыток 36.4% 48.5%
Нестабильные тесты 2 2
Всего запусков 66 66
Стоимость за результат 0.627 0.751
Общая стоимость $0.044 $0.073
Цена входа $0.300 / 1M $0.260 / 1M
Цена выхода $1.200 / 1M $1.560 / 1M
Общее число входных токенов 108,743 102,646
Выходные токены 9,372 29,370
Токены рассуждений 0 0
Время ответа (среднее) 5.18s 9.85s
Время ответа (макс.) 48.38s 123.00s
Время ответа (суммарно) 113.95s 157.63s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#111 LongCat 2.0

none
Стоимость
$0.027
Время
411.7s
Токены
22,283 tok

#107 Qwen3.5 Plus 2026-02-15

none
Стоимость
$0.012
Время
153.2s
Токены
7,787 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
LongCat 2.0 5.5 10.0 33.3% 0 2.85s 7,446 578 0
Qwen3.5 Plus 2026-02-15 4.3 7.9 11.1% 1 2.05s 7,913 473 0

Быстрое сравнение

Сменить пару сравнения