Navigasi
Advertise here

Granite 4.2 8B vs KAT Coder AIR V2.5 (default)

Skor rata-rata hampir imbang di 4.4 vs 4.4. Granite 4.2 8B memiliki biaya benchmark lebih rendah di $0.037 vs $0.070. KAT Coder AIR V2.5 (default) lebih cepat di 11.96s vs 84.66s, dengan tingkat keberhasilan 15.9% vs 34.8%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#350
Total token output
133,268
Waktu respons (rata-rata)
84.66s
Total Biaya
$0.037
Peringkat
#348
Total token output
97,752
Waktu respons (rata-rata)
11.96s
Total Biaya
$0.070
Model yang direkomendasikan KAT Coder AIR V2.5 (default)

It has the best score here (4.4), while responding about 7.1x faster than Granite 4.2 8B.

Perbandingan terperinci

Metrik Granite 4.2 8B Granite 4.2 8B none Rilis: 2026-09-02 KAT Coder AIR V2.5 KAT Coder AIR V2.5 default Rilis: 2026-07-14
Skor 4.4 4.4
Peringkat #350 #348
Keandalan 9.1 10.0
Konsistensi 9.3 7.4
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 15.9% 34.8%
Tes tidak stabil 2 7
Total Run 69 69
Biaya per hasil 1.206 1.382
Total Biaya $0.037 $0.070
Harga input $0.060 / 1M $0.150 / 1M
Harga output $0.250 / 1M $0.600 / 1M
Harga baca cache $0.015 / 1M T/A
Harga tulis cache T/A T/A
Total token input 226,872 69,376
Token output 133,268 7,792
Token penalaran 0 89,960
Waktu respons (rata-rata) 84.66s 11.96s
Waktu respons (maks) 747.17s 121.05s
Waktu respons (total) 1947.17s 275.18s
Parameter 8B ~35B total (~3B aktif)
Ketersediaan Sumber terbuka Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#350 IBM: Granite 4.2 8B

none
Provider returned error
Biaya
$0.000
Waktu
0.2s
Token
0 tok

#348 KAT Coder AIR V2.5

default
Biaya
$0.002
Waktu
14.5s
Token
2,619 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Granite 4.2 8B 5.5 10.0 33.3% 0 105.60s 8,358 47,944 0
KAT Coder AIR V2.5 3.3 9.6 0.0% 0 14.31s 6,472 2,032 14,886

Perbandingan Cepat

Ganti Pasangan Perbandingan