Навигация
AI BENCHY
Advertise here

Kwaipilot: KAT-Coder-Pro V2.5 vs Meituan: LongCat 2.0

Средний балл практически равен: 7.4 vs 7.4. KAT-Coder-Pro V2.5 (low) имеет более низкую стоимость benchmark: $0.387 vs $0.478. KAT-Coder-Pro V2.5 (low) быстрее: 19.47s vs 136.64s, с долей успешных попыток 69.7% vs 60.6%.

Рекомендуемая модельKAT-Coder-Pro V2.5 (low)Здесь у него лучший балл (7.4), и он отвечает примерно в 7.0 раза быстрее, чем LongCat 2.0 (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-20

Метрика KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 low Релиз: 2026-07-14 LongCat 2.0 LongCat 2.0 medium Релиз: 2026-07-20
Оценка 7.4 7.4
Ранг #62 #60
Надежность 10.0 9.8
Стабильность 7.0 8.9
Тестов верно
Доля успешных попыток 69.7% 60.6%
Нестабильные тесты 8 3
Всего запусков 66 66
Стоимость за результат 3.514 3.978
Общая стоимость $0.387 $0.478
Цена входа $0.740 / 1M $0.300 / 1M
Цена выхода $2.960 / 1M $1.200 / 1M
Общее число входных токенов 87,673 97,315
Выходные токены 7,166 44,384
Токены рассуждений 101,474 329,012
Время ответа (среднее) 19.47s 136.64s
Время ответа (макс.) 209.15s 939.52s
Время ответа (суммарно) 428.31s 3006.01s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 KAT-Coder-Pro V2.5

low
Стоимость
$0.016
Время
47.6s
Токены
5,182 tok

#60 LongCat 2.0

medium
Стоимость
$0.016
Время
285.1s
Токены
13,057 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 24.87s 7,893 402 24,945
LongCat 2.0 10.0 10.0 100.0% 0 455.00s 7,419 533 214,143

Быстрое сравнение

Сменить пару сравнения