Navigasi
AI BENCHY
Advertise here

KAT-Coder-Air V2.5 vs GPT-5.4 Nano

Skor rata-rata hampir imbang di 4.8 vs 4.8. GPT-5.4 Nano memiliki biaya benchmark lebih rendah di $0.041 vs $0.067. GPT-5.4 Nano lebih cepat di 2.57s vs 12.17s, dengan tingkat keberhasilan 37.9% vs 28.8%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-28

Peringkat
#204
Total token output
93,913
Waktu respons (rata-rata)
12.17s
Total Biaya
$0.067
Peringkat
#201
Total token output
13,794
Waktu respons (rata-rata)
2.57s
Total Biaya
$0.041
Model yang direkomendasikan GPT-5.4 Nano

It has the best score here (4.8), while costing about 1.7x less than KAT-Coder-Air V2.5.

Perbandingan terperinci

Metrik KAT-Coder-Air V2.5 KAT-Coder-Air V2.5 none Rilis: 2026-07-14 GPT-5.4 Nano GPT-5.4 Nano none Rilis: 2026-03-17
Skor 4.8 4.8
Peringkat #204 #201
Keandalan 10.0 10.0
Konsistensi 6.9 8.2
Tes benar
Tingkat lulus per percobaan 37.9% 28.8%
Tes tidak stabil 8 5
Total Run 66 66
Biaya per hasil 1.336 1.011
Total Biaya $0.067 $0.041
Harga input $0.150 / 1M $0.200 / 1M
Harga output $0.600 / 1M $1.250 / 1M
Total token input 69,367 115,924
Token output 93,913 13,794
Token penalaran 0 0
Waktu respons (rata-rata) 12.17s 2.57s
Waktu respons (maks) 121.05s 25.50s
Waktu respons (total) 267.83s 56.51s

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#204 KAT-Coder-Air V2.5

none
Biaya
$0.002
Waktu
14.5s
Token
2,619 tok

#201 GPT-5.4 Nano

none
Biaya
$0.008
Waktu
46.1s
Token
5,735 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
KAT-Coder-Air V2.5 3.3 9.6 0.0% 0 14.31s 6,472 16,918 0
GPT-5.4 Nano 4.6 7.9 22.2% 1 2.22s 7,305 613 0

Perbandingan Cepat

Ganti Pasangan Perbandingan