Navigate
AI BENCHY
Advertise here

KAT-Coder-Air V2.5 vs GPT-5.4 Nano

The average score is effectively tied at 4.8 vs 4.8. GPT-5.4 Nano has the lower benchmark cost at $0.041 vs $0.067. GPT-5.4 Nano is faster at 2.57s vs 12.17s, with pass rates of 37.9% vs 28.8%.

Last updated at: 2026-07-28

Rank
#204
Total Output Tokens
93,913
Response Time (avg)
12.17s
Total Cost
$0.067
Rank
#201
Total Output Tokens
13,794
Response Time (avg)
2.57s
Total Cost
$0.041
Recommended model GPT-5.4 Nano

It has the best score here (4.8), while costing about 1.7x less than KAT-Coder-Air V2.5.

Detailed comparison

Metric KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 none Release: 2026-07-14 GPT-5.4 Nano GPT-5.4 Nano none Release: 2026-03-17
Score 4.8 4.8
Rank #204 #201
Reliability 10.0 10.0
Consistency 6.9 8.2
Tests Correct
Attempt pass rate 37.9% 28.8%
Flaky tests 8 5
Total Runs 66 66
Cost per result 1.336 1.011
Total Cost $0.067 $0.041
Input Price $0.150 / 1M $0.200 / 1M
Output Price $0.600 / 1M $1.250 / 1M
Total Input Tokens 69,367 115,924
Output Tokens 93,913 13,794
Reasoning Tokens 0 0
Response Time (avg) 12.17s 2.57s
Response Time (max) 121.05s 25.50s
Response Time (total) 267.83s 56.51s

Model generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#204 KAT-Coder-Air V2.5

none
Cost
$0.002
Time
14.5s
Tokens
2,619 tok

#201 GPT-5.4 Nano

none
Cost
$0.008
Time
46.1s
Tokens
5,735 tok

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Coding Score Consistency Attempt pass rate Flaky tests Tests Correct Response Time (avg) Input Tokens Output Tokens Reasoning Tokens
KAT-Coder-Air V2.5 3.3 9.6 0.0% 0 14.31s 6,472 16,918 0
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0

Quick Compare

Switch Comparison Pair