Navigasi
Advertise here

Granite 4.1 8b (default) vs gpt-oss-120b

gpt-oss-120b unggul dalam skor rata-rata dengan 4.2 vs 3.8. Granite 4.1 8b (default) memiliki biaya benchmark lebih rendah di $0.007 vs $0.016. Granite 4.1 8b (default) lebih cepat di 1.38s vs 28.63s, dengan tingkat keberhasilan 8.7% vs 34.8%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#366
Total token output
5,996
Waktu respons (rata-rata)
1.38s
Total Biaya
$0.007
Peringkat
#356
Total token output
62,213
Waktu respons (rata-rata)
28.63s
Total Biaya
$0.016
Model yang direkomendasikan Granite 4.1 8b (default)

Its score stays close to the best score here (3.8 vs 4.2), while costing about 2.5x less than gpt-oss-120b.

Perbandingan terperinci

Metrik Granite 4.1 8b Granite 4.1 8b default Rilis: 2026-05-01 gpt-oss-120b gpt-oss-120b none Rilis: 2025-08-05
Skor 3.8 4.2
Peringkat #366 #356
Keandalan 10.0 10.0
Konsistensi 10.0 7.6
Percobaan 69/69 60/69
Tes benar
Tingkat lulus per percobaan 8.7% 34.8%
Tes tidak stabil 0 3
Total Run 69 60
Biaya per hasil 0.315 0.274
Total Biaya $0.007 $0.016
Harga input $0.050 / 1M $0.037 / 1M
Harga output $0.100 / 1M $0.170 / 1M
Harga baca cache T/A T/A
Harga tulis cache T/A T/A
Total token input 113,836 131,652
Token output 5,996 16,869
Token penalaran 0 53,081
Waktu respons (rata-rata) 1.38s 28.63s
Waktu respons (maks) 16.67s 140.90s
Waktu respons (total) 31.81s 486.69s
Parameter 8B 117B total (5.1B aktif)
Ketersediaan Sumber terbuka Sumber terbuka

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#366 Granite 4.1 8b

default
Biaya
$0.001
Waktu
3.2s
Token
491 tok

#356 gpt-oss-120b

none
Belum ada hasil showcase yang dihasilkan untuk model ini.
Biaya
T/A
Waktu
-
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Granite 4.1 8b 4.5 10.0 0.0% 0 775ms 8,344 525 0
gpt-oss-120b 1.5 0.4 22.2% 1 9.57s 901 204 3,028

Perbandingan Cepat

Ganti Pasangan Perbandingan