Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Granite 4.2 8B vs gpt-oss-120b

Granite 4.2 8B unggul dalam skor rata-rata dengan 4.4 vs 4.2. gpt-oss-120b memiliki biaya benchmark lebih rendah di $0.016 vs $0.037. gpt-oss-120b lebih cepat di 28.63s vs 84.66s, dengan tingkat keberhasilan 15.9% vs 34.8%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#355
Total token output
133,268
Waktu respons (rata-rata)
84.66s
Total Biaya
$0.037
Peringkat
#361
Total token output
62,213
Waktu respons (rata-rata)
28.63s
Total Biaya
$0.016
Model yang direkomendasikan gpt-oss-120b

Its score stays close to the best score here (4.2 vs 4.4), while costing about 2.3x less than Granite 4.2 8B.

Perbandingan terperinci

Metrik Granite 4.2 8B Granite 4.2 8B none Rilis: 2026-09-02 gpt-oss-120b gpt-oss-120b none Rilis: 2025-08-05
Skor 4.4 4.2
Peringkat #355 #361
Keandalan 9.1 10.0
Konsistensi 9.3 7.6
Percobaan 69/69 60/69
Tes benar
Tingkat lulus per percobaan 15.9% 34.8%
Tes tidak stabil 2 3
Total Run 69 60
Biaya per hasil 1.206 0.274
Total Biaya $0.037 $0.016
Harga input $0.060 / 1M $0.037 / 1M
Harga output $0.250 / 1M $0.170 / 1M
Harga baca cache $0.015 / 1M T/A
Harga tulis cache T/A T/A
Total token input 226,872 131,652
Token output 133,268 16,869
Token penalaran 0 53,081
Waktu respons (rata-rata) 84.66s 28.63s
Waktu respons (maks) 747.17s 140.90s
Waktu respons (total) 1947.17s 486.69s
Parameter 8B 117B total (5.1B aktif)
Ketersediaan Sumber terbuka Sumber terbuka

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#355 IBM: Granite 4.2 8B

none
Provider returned error
Biaya
$0.000
Waktu
0.2s
Token
0 tok

#361 gpt-oss-120b

none
Belum ada hasil showcase yang dihasilkan untuk model ini.
Biaya
T/A
Waktu
-
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Granite 4.2 8B 5.5 10.0 33.3% 0 105.60s 8,358 47,944 0
gpt-oss-120b 1.5 0.4 22.2% 1 9.57s 901 204 3,028

Ganti Pasangan Perbandingan