Навигация
Advertise here

KAT-Coder-Pro V2.5 (medium) vs GPT-6 Luna (low)

GPT-6 Luna (low) лидирует по среднему баллу: 7.0 vs 6.9. GPT-6 Luna (low) имеет более низкую стоимость benchmark: $0.020 vs $0.478. GPT-6 Luna (low) быстрее: 21.96s vs 24.87s, с долей успешных попыток 65.2% vs 62.1%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-23

Сравниваемые модели

Ранг
#167
Общее число выходных токенов
139,375
Время ответа (среднее)
24.87s
Общая стоимость
$0.478
Ранг
#159
Общее число выходных токенов
22,605
Время ответа (среднее)
21.96s
Общая стоимость
$0.020
Рекомендуемая модель GPT-6 Luna (low)

Здесь у него лучший балл (7.0), при этом он примерно в 24.7 раза дешевле, чем KAT-Coder-Pro V2.5 (medium).

Подробное сравнение

Метрика KAT-Coder-Pro V2.5 KAT-Coder-Pro V2.5 medium Релиз: 2026-07-14 GPT-6 Luna GPT-6 Luna low Релиз: 2026-09-23
Оценка 6.9 7.0
Ранг #167 #159
Надежность 10.0 9.6
Стабильность 7.0 8.5
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 65.2% 62.1%
Нестабильные тесты 8 4
Всего запусков 66 66
Стоимость за результат 4.342 0.176
Общая стоимость $0.478 $0.020
Цена входа $0.740 / 1M $0.100 / 1M
Цена выхода $2.960 / 1M $0.500 / 1M
Общее число входных токенов 87,916 80,159
Выходные токены 7,213 4,623
Токены рассуждений 132,162 17,982
Время ответа (среднее) 24.87s 21.96s
Время ответа (макс.) 257.00s 89.37s
Время ответа (суммарно) 547.14s 483.19s
Параметры ~700B всего (~72B активных) ~400B всего (~17B активных)
Доступность Закрытая модель Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#167 KAT-Coder-Pro V2.5

medium
Стоимость
$0.009
Время
25.6s
Токены
2,939 tok

#159 GPT-6 Luna

low
Стоимость
$0.002
Время
19.2s
Токены
2,598 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
KAT-Coder-Pro V2.5 7.8 10.0 66.7% 0 33.10s 7,893 416 33,658
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

Быстрое сравнение

Сменить пару сравнения