AI BENCHY
Advertise here
#108

KAT-Coder-Pro V2.5

Kwaipilot Релиз: 2026-07-14 Проверено: 2026-08-14 03:25 kwaipilot/kat-coder-pro-v2.5::high
~700B всего (~72B активных)MoEЗакрытая модельОценка

Сводка

KAT-Coder-Pro V2.5 набирает 7.2 в AI BENCHY и занимает #108. У модели надежность 10.0, доля успешных попыток 63.6%, общая стоимость $0.506 и среднее время ответа 22.11s.

Что делает KAT-Coder-Pro V2.5 особенной: Сильнее всего модель выделяется в Комбинированный, где занимает #3; самая слабая область — Предметно-ориентированное с #16.

Сведения о модели

Дата исследования: 2026-08-12

Оценка
Параметры
~700B всего (~72B активных)
Архитектура
MoE
Доступность
Закрытая модель
Лицензия
-

Наиболее обоснованная оценка по открытым данным; поставщик раскрыл не все значения.

Стабильность

7.8

Общее число выходных токенов

144,359

Общее число входных токенов

106,085

Цена входа

$0.740 / 1M

Цена выхода

$2.960 / 1M

Тестов верно

Ошибочных тестов: 11

Доля успешных попыток: 63.6%

Нестабильные тесты

6

Нестабильные тесты имели смешанные результаты между прогонами (как минимум один успех и один провал).

Время ответа (среднее)

22.11s

Время ответа (макс.): 199.97s

Время ответа (суммарно): 486.31s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#108 KAT-Coder-Pro V2.5

high
Стоимость
$0.009
Время
26.4s
Токены
3,117 tok

История запусков

Проверено Оценка Надежность Тестов верно Общая стоимость Сравнить
2026-08-14 03:25 Повторный тест 7.2 10.0 $0.506 Текущий запуск
2026-07-16 23:38 Добавлен новый тест 7.2 10.0 $0.482 Сравнить
2026-07-14 11:05 Первый запуск 7.7 10.0 $0.246 Сравнить

Этот запуск использовал другой набор бенчмарков. Учитывайте изменения набора при чтении исторической динамики.

История цен

Исторические данные о ценах для этой модели из OpenRouter.

Дата Цена входа Цена выхода
2026-08-14 12:51 $0.740 / 1M $2.960 / 1M

Графики

Выберите первую модель, затем нажмите вторую, чтобы открыть страницу сравнения бок о бок.

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Быстрое сравнение

Разбивка по категориям

Категория Оценка Стабильность Тестов верно
Анти-ИИ уловки 7.0 8.0
Программирование 6.4 7.9
Комбинированный 7.3 5.8
Парсинг и извлечение данных 10.0 10.0
Предметно-ориентированное 2.9 4.4
Общий интеллект 5.1 10.0
Следование инструкциям 9.9 10.0
Решение головоломок 8.2 7.2
Вызов инструментов 10.0 10.0
Эрудиция 3.0 10.0

Сравниваемые модели