Навигация
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

KAT-Coder-Air V2.5 (high) vs GPT-6 Luna

KAT-Coder-Air V2.5 (high) лидирует по среднему баллу: 5.6 vs 5.6. GPT-6 Luna имеет более низкую стоимость benchmark: $0.012 vs $0.077. KAT-Coder-Air V2.5 (high) быстрее: 15.87s vs 19.08s, с долей успешных попыток 42.4% vs 42.4%.

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-09-23

Сравниваемые модели

Ранг
#257
Общее число выходных токенов
114,654
Время ответа (среднее)
15.87s
Общая стоимость
$0.077
Ранг
#260
Общее число выходных токенов
5,508
Время ответа (среднее)
19.08s
Общая стоимость
$0.012
Рекомендуемая модель GPT-6 Luna

Его балл близок к лучшему здесь (5.6 против 5.6), при этом он примерно в 6.7 раза дешевле, чем KAT-Coder-Air V2.5 (high).

Подробное сравнение

Метрика KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 high Релиз: 2026-07-14 GPT-6 Luna GPT-6 Luna none Релиз: 2026-09-23
Оценка 5.6 5.6
Ранг #257 #260
Надежность 9.8 9.9
Стабильность 8.1 8.1
Попытки 66/66 66/66
Тестов верно
Доля успешных попыток 42.4% 42.4%
Нестабильные тесты 5 5
Всего запусков 66 66
Стоимость за результат 1.091 0.164
Общая стоимость $0.077 $0.012
Цена входа $0.150 / 1M $0.100 / 1M
Цена выхода $0.600 / 1M $0.500 / 1M
Общее число входных токенов 50,423 87,216
Выходные токены 4,144 5,508
Токены рассуждений 110,510 0
Время ответа (среднее) 15.87s 19.08s
Время ответа (макс.) 118.35s 98.62s
Время ответа (суммарно) 349.16s 419.83s
Параметры ~35B всего (~3B активных) ~400B всего (~17B активных)
Доступность Закрытая модель Закрытая модель

Генерация showcase моделей

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#257 KAT-Coder-Air V2.5

high
Reached the allocated time limit (300 seconds) without receiving showcase output.
Стоимость
$0.000
Время
300.0s
Токены
0 tok

#260 GPT-6 Luna

none
Стоимость
$0.002
Время
26.0s
Токены
3,235 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
KAT-Coder-Air V2.5 4.3 7.3 11.1% 1 39.07s 6,948 1,166 55,883
GPT-6 Luna 5.5 10.0 33.3% 0 8.04s 7,302 376 0

Быстрое сравнение

Сменить пару сравнения