Навигация
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

KAT-Coder-Pro V2.5 (medium) vs Grok 4.20 (medium)

Grok 4.20 (medium) лидирует по среднему баллу: 7.0 vs 6.9. KAT-Coder-Pro V2.5 (medium) имеет более низкую стоимость benchmark: $0.478 vs $0.805. KAT-Coder-Pro V2.5 (medium) быстрее: 24.87s vs 32.56s, с долей успешных попыток 65.2% vs 60.6%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-08-15

Ранг
#123
Общее число выходных токенов
139,375
Время ответа (среднее)
24.87s
Общая стоимость
$0.478
Ранг
#120
Общее число выходных токенов
270,259
Время ответа (среднее)
32.56s
Общая стоимость
$0.805
Рекомендуемая модель KAT-Coder-Pro V2.5 (medium)

Его балл близок к лучшему здесь (6.9 против 7.0), при этом он примерно в 1.7 раза дешевле, чем Grok 4.20 (medium).

Подробное сравнение

Метрика KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 medium Релиз: 2026-07-14 Grok 4.20 Grok 4.20 medium Релиз: 2026-03-31
Оценка 6.9 7.0
Ранг #123 #120
Надежность 10.0 10.0
Стабильность 7.0 8.2
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 65.2% 60.6%
Нестабильные тесты 8 5
Всего запусков 66 66
Стоимость за результат 4.342 10.365
Общая стоимость $0.478 $0.805
Цена входа $0.740 / 1M $1.250 / 1M
Цена выхода $2.960 / 1M $2.500 / 1M
Общее число входных токенов 87,916 102,986
Выходные токены 7,213 5,860
Токены рассуждений 132,162 264,399
Время ответа (среднее) 24.87s 32.56s
Время ответа (макс.) 257.00s 199.66s
Время ответа (суммарно) 547.14s 716.36s
Параметры ~700B всего (~72B активных) ~1T всего (~100B активных)
Доступность Закрытая модель Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#123 KAT-Coder-Pro V2.5

medium
Стоимость
$0.009
Время
25.6s
Токены
2,939 tok

#120 SpaceXAI: Grok 4.20

medium
Стоимость
$0.041
Время
110.3s
Токены
16,336 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 33.10s 7,893 416 33,658
Grok 4.20 6.3 6.6 55.6% 1 109.93s 8,307 268 103,150

Быстрое сравнение

Сменить пару сравнения