Навигация
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Qwen: Qwen3.5 Plus 2026-02-15

Qwen3.5 Plus 2026-02-15 (medium) лидирует по среднему баллу: 7.5 vs 7.4. Qwen3.5 Plus 2026-02-15 (medium) имеет более низкую стоимость benchmark: $0.437 vs $0.478. Qwen3.5 Plus 2026-02-15 (medium) быстрее: 89.19s vs 136.64s, с долей успешных попыток 60.6% vs 71.2%.

Рекомендуемая модельQwen3.5 Plus 2026-02-15 (medium)Здесь у него лучший балл (7.5), и он отвечает примерно в 1.5 раза быстрее, чем LongCat 2.0 (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-20

Метрика LongCat 2.0 LongCat 2.0 medium Релиз: 2026-07-20 Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Релиз: 2026-02-15
Оценка 7.4 7.5
Ранг #60 #57
Надежность 9.8 10.0
Стабильность 8.9 8.5
Тестов верно
Доля успешных попыток 60.6% 71.2%
Нестабильные тесты 3 4
Всего запусков 66 66
Стоимость за результат 3.978 3.348
Общая стоимость $0.478 $0.437
Цена входа $0.300 / 1M $0.260 / 1M
Цена выхода $1.200 / 1M $1.560 / 1M
Общее число входных токенов 97,315 113,560
Выходные токены 44,384 9,823
Токены рассуждений 329,012 250,881
Время ответа (среднее) 136.64s 89.19s
Время ответа (макс.) 939.52s 304.85s
Время ответа (суммарно) 3006.01s 1337.92s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 LongCat 2.0

medium
Стоимость
$0.016
Время
285.1s
Токены
13,057 tok

#57 Qwen3.5 Plus 2026-02-15

medium
Стоимость
$0.011
Время
125.5s
Токены
7,040 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143
Qwen3.5 Plus 2026-02-15 6.6 7.1 44.4% 1 180.70s 6,950 420 80,595

Быстрое сравнение

Сменить пару сравнения