Навигация
AI BENCHY
Advertise here

Meituan: LongCat 2.0 vs Qwen: Qwen3.6 35B A3B

Средний балл практически равен: 6.7 vs 6.7. LongCat 2.0 (low) имеет более низкую стоимость benchmark: $0.391 vs $0.746. Qwen3.6 35B A3B (medium) быстрее: 58.06s vs 100.31s, с долей успешных попыток 53.0% vs 60.6%.

Рекомендуемая модельLongCat 2.0 (low)Здесь у него лучший балл (6.7), при этом он примерно в 1.9 раза дешевле, чем Qwen3.6 35B A3B (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-20

Метрика LongCat 2.0 LongCat 2.0 low Релиз: 2026-07-20 Qwen3.6 35B A3B Qwen3.6 35B A3B medium Релиз: 2026-04-20
Оценка 6.7 6.7
Ранг #91 #90
Надежность 9.6 10.0
Стабильность 8.9 9.6
Тестов верно
Доля успешных попыток 53.0% 60.6%
Нестабильные тесты 3 1
Всего запусков 66 66
Стоимость за результат 3.910 5.712
Общая стоимость $0.391 $0.746
Цена входа $0.300 / 1M $0.140 / 1M
Цена выхода $1.200 / 1M $1.000 / 1M
Общее число входных токенов 90,909 85,139
Выходные токены 5,679 61,819
Токены рассуждений 297,369 678,766
Время ответа (среднее) 100.31s 58.06s
Время ответа (макс.) 560.39s 817.57s
Время ответа (суммарно) 2206.82s 1161.18s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 LongCat 2.0

low
Стоимость
$0.024
Время
428.0s
Токены
19,557 tok

#90 Qwen3.6 35B A3B

medium
Неверный SVG
Стоимость
$0.000
Время
300.0s
Токены
0 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627
Qwen3.6 35B A3B 7.7 10.0 66.7% 0 50.55s 5,051 7,929 37,223

Быстрое сравнение

Сменить пару сравнения