Навигация
AI BENCHY
Advertise here

Kwaipilot: KAT-Coder-Pro V2.5 vs Meituan: LongCat 2.0

Средний балл практически равен: 6.7 vs 6.7. LongCat 2.0 (low) имеет более низкую стоимость benchmark: $0.391 vs $0.476. KAT-Coder-Pro V2.5 быстрее: 25.56s vs 100.31s, с долей успешных попыток 68.2% vs 53.0%.

Рекомендуемая модельKAT-Coder-Pro V2.5Здесь у него лучший балл (6.7), и он отвечает примерно в 3.9 раза быстрее, чем LongCat 2.0 (low).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-20

Метрика KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 none Релиз: 2026-07-14 LongCat 2.0 LongCat 2.0 low Релиз: 2026-07-20
Оценка 6.7 6.7
Ранг #92 #91
Надежность 10.0 9.6
Стабильность 7.4 8.9
Тестов верно
Доля успешных попыток 68.2% 53.0%
Нестабильные тесты 7 3
Всего запусков 66 66
Стоимость за результат 4.319 3.910
Общая стоимость $0.476 $0.391
Цена входа $0.740 / 1M $0.300 / 1M
Цена выхода $2.960 / 1M $1.200 / 1M
Общее число входных токенов 98,499 90,909
Выходные токены 135,861 5,679
Токены рассуждений 0 297,369
Время ответа (среднее) 25.56s 100.31s
Время ответа (макс.) 335.41s 560.39s
Время ответа (суммарно) 562.43s 2206.82s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#92 KAT-Coder-Pro V2.5

none
Стоимость
$0.010
Время
29.0s
Токены
3,439 tok

#91 LongCat 2.0

low
Стоимость
$0.024
Время
428.0s
Токены
19,557 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
KAT-Coder-Pro V2.5 6.1 4.7 66.7% 2 22.52s 7,893 22,440 0
LongCat 2.0 6.6 4.6 77.8% 2 479.30s 6,544 461 206,627

Быстрое сравнение

Сменить пару сравнения