Навигация
Advertise here

KAT-Coder-Air V2.5 (medium) vs GPT-6 Luna

Средний балл практически равен: 5.6 vs 5.6. GPT-6 Luna имеет более низкую стоимость benchmark: $0.012 vs $0.048. KAT-Coder-Air V2.5 (medium) быстрее: 8.65s vs 19.08s, с долей успешных попыток 45.5% vs 42.4%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-23

Сравниваемые модели

Ранг
#264
Общее число выходных токенов
66,576
Время ответа (среднее)
8.65s
Общая стоимость
$0.048
Ранг
#260
Общее число выходных токенов
5,508
Время ответа (среднее)
19.08s
Общая стоимость
$0.012
Рекомендуемая модель KAT-Coder-Air V2.5 (medium)

Здесь у него лучший балл (5.6), и он отвечает примерно в 2.2 раза быстрее, чем GPT-6 Luna.

Подробное сравнение

Метрика KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 medium Релиз: 2026-07-14 GPT-6 Luna GPT-6 Luna none Релиз: 2026-09-23
Оценка 5.6 5.6
Ранг #264 #260
Надежность 9.6 9.9
Стабильность 8.9 8.1
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 45.5% 42.4%
Нестабильные тесты 3 5
Всего запусков 66 66
Стоимость за результат 0.596 0.164
Общая стоимость $0.048 $0.012
Цена входа $0.150 / 1M $0.100 / 1M
Цена выхода $0.600 / 1M $0.500 / 1M
Общее число входных токенов 51,369 87,216
Выходные токены 8,008 5,508
Токены рассуждений 58,568 0
Время ответа (среднее) 8.65s 19.08s
Время ответа (макс.) 48.19s 98.62s
Время ответа (суммарно) 190.35s 419.83s
Параметры ~35B всего (~3B активных) ~400B всего (~17B активных)
Доступность Закрытая модель Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#264 KAT-Coder-Air V2.5

medium
Стоимость
$0.003
Время
23.7s
Токены
4,924 tok

#260 GPT-6 Luna

none
Стоимость
$0.002
Время
26.0s
Токены
3,235 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
KAT-Coder-Air V2.5 3.6 7.0 22.2% 1 23.37s 7,893 5,199 29,973
GPT-6 Luna 5.5 10.0 33.3% 0 8.04s 7,302 376 0

Быстрое сравнение

Сменить пару сравнения