Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Granite 4.2 8B — low vs medium

Skor rata-rata hampir imbang di 5.1 vs 5.2. medium memiliki biaya benchmark lebih rendah di $0.009 vs $0.012. medium lebih cepat di 45.97s vs 54.36s, dengan tingkat keberhasilan 31.8% vs 34.9%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-02

Peringkat
#247
Total token output
27,928
Waktu respons (rata-rata)
54.36s
Total Biaya
$0.012
Peringkat
#243
Total token output
19,330
Waktu respons (rata-rata)
45.97s
Total Biaya
$0.009
Model yang direkomendasikan medium

It has the strongest score in this comparison (5.2) and the best overall balance of cost and response time across all 2 models.

Perbandingan terperinci

Metrik Granite 4.2 8B Granite 4.2 8B low Rilis: 2026-09-02 Granite 4.2 8B Granite 4.2 8B medium Rilis: 2026-09-02
Skor 5.1 5.2
Peringkat #247 #243
Keandalan 9.0 8.7
Konsistensi 10.0 9.6
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 31.8% 34.9%
Tes tidak stabil 0 1
Total Run 66 66
Biaya per hasil 0.167 0.117
Total Biaya $0.012 $0.009
Harga input $0.100 / 1M $0.100 / 1M
Harga output $0.150 / 1M $0.150 / 1M
Total token input 74,721 52,909
Token output 9,205 7,058
Token penalaran 18,723 12,272
Waktu respons (rata-rata) 54.36s 45.97s
Waktu respons (maks) 566.80s 557.96s
Waktu respons (total) 1195.97s 1011.42s
Parameter 8B 8B
Ketersediaan Sumber terbuka Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#247 IBM: Granite 4.2 8B

low
Provider returned error
Biaya
$0.000
Waktu
0.2s
Token
0 tok

#243 IBM: Granite 4.2 8B

medium
Provider returned error
Biaya
$0.000
Waktu
0.2s
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Granite 4.2 8B 5.5 10.0 33.3% 0 13.01s 8,439 2,469 2,984
Granite 4.2 8B 5.5 10.0 33.3% 0 12.09s 8,439 2,445 3,900

Perbandingan Cepat

Ganti Pasangan Perbandingan