Навигация
AI BENCHY
Advertise here

Kwaipilot: KAT-Coder-Air V2.5 vs OpenAI: GPT-5.4 Mini

GPT-5.4 Mini лидирует по среднему баллу: 5.9 vs 5.6. KAT-Coder-Air V2.5 (medium) имеет более низкую стоимость benchmark: $0.048 vs $0.095. GPT-5.4 Mini быстрее: 1.53s vs 8.42s, с долей успешных попыток 45.5% vs 33.3%.

Рекомендуемая модельGPT-5.4 MiniЗдесь у него лучший балл (5.9), и он отвечает примерно в 5.5 раза быстрее, чем KAT-Coder-Air V2.5 (medium).

Бенчмарки сгенерированы из тестовых наборов AI BENCHY в: 2026-07-21

Метрика KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 medium Релиз: 2026-07-14 GPT-5.4 Mini GPT-5.4 Mini none Релиз: 2026-03-17
Оценка 5.6 5.9
Ранг #155 #142
Надежность 9.9 10.0
Стабильность 8.9 8.9
Тестов верно
Доля успешных попыток 45.5% 33.3%
Нестабильные тесты 3 3
Всего запусков 66 66
Стоимость за результат 0.593 1.580
Общая стоимость $0.048 $0.095
Цена входа $0.150 / 1M $0.750 / 1M
Цена выхода $0.600 / 1M $4.500 / 1M
Общее число входных токенов 51,472 79,067
Выходные токены 7,822 7,880
Токены рассуждений 58,352 0
Время ответа (среднее) 8.42s 1.53s
Время ответа (макс.) 48.19s 9.92s
Время ответа (суммарно) 185.24s 33.74s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#155 KAT-Coder-Air V2.5

medium
Стоимость
$0.003
Время
23.7s
Токены
4,924 tok

#142 GPT-5.4 Mini

none
Стоимость
$0.010
Время
11.7s
Токены
2,151 tok

Лучшие модели по оценке

Оценка vs общая стоимость

Время ответа (среднее)

Оценка vs Время ответа (среднее)

Общее число выходных токенов

Оценка vs Общее число выходных токенов

Разбивка по категориям

Программирование Оценка Стабильность Доля успешных попыток Нестабильные тесты Тестов верно Время ответа (среднее) Входные токены Выходные токены Токены рассуждений
KAT-Coder-Air V2.5 3.6 7.0 22.2% 1 23.37s 7,893 5,199 29,973
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0

Быстрое сравнение

Сменить пару сравнения