Навигация
AI BENCHY
Advertise here

KAT-Coder-Air V2.5 (medium) vs GPT-5.6 Luna

KAT-Coder-Air V2.5 (medium) лидирует по среднему баллу: 5.6 vs 5.4. GPT-5.6 Luna имеет более низкую стоимость benchmark: $0.029 vs $0.048. GPT-5.6 Luna быстрее: 1.50s vs 8.65s, с долей успешных попыток 45.5% vs 36.4%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-04

Ранг
#231
Общее число выходных токенов
66,576
Время ответа (среднее)
8.65s
Общая стоимость
$0.048
Ранг
#241
Общее число выходных токенов
6,709
Время ответа (среднее)
1.50s
Общая стоимость
$0.029
Рекомендуемая модель GPT-5.6 Luna

Его балл близок к лучшему здесь (5.4 против 5.6), при этом он примерно в 1.7 раза дешевле, чем KAT-Coder-Air V2.5 (medium).

Подробное сравнение

Метрика KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 medium Релиз: 2026-07-14 GPT-5.6 Luna GPT-5.6 Luna none Релиз: 2026-07-09
Оценка 5.6 5.4
Ранг #231 #241
Надежность 9.6 10.0
Стабильность 8.9 8.8
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 45.5% 36.4%
Нестабильные тесты 3 3
Всего запусков 66 66
Стоимость за результат 0.596 2.357
Общая стоимость $0.048 $0.029
Цена входа $0.150 / 1M $0.200 / 1M
Цена выхода $0.600 / 1M $1.200 / 1M
Общее число входных токенов 51,369 101,332
Выходные токены 8,008 6,709
Токены рассуждений 58,568 0
Время ответа (среднее) 8.65s 1.50s
Время ответа (макс.) 48.19s 10.57s
Время ответа (суммарно) 190.35s 33.05s
Параметры ~35B всего (~3B активных) ~400B всего (~17B активных)
Доступность Закрытая модель Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#231 KAT-Coder-Air V2.5

medium
Стоимость
$0.003
Время
23.7s
Токены
4,924 tok

#241 GPT-5.6 Luna

none
Стоимость
$0.016
Время
15.8s
Токены
2,685 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
KAT-Coder-Air V2.5 3.6 7.0 22.2% 1 23.37s 7,893 5,199 29,973
GPT-5.6 Luna 3.8 7.2 22.2% 1 980ms 7,302 459 0

Быстрое сравнение

Сменить пару сравнения