Navigasi
Advertise here

Granite 4.2 8B (high) vs gpt-oss-120b

Granite 4.2 8B (high) unggul dalam skor rata-rata dengan 4.6 vs 3.7. gpt-oss-120b memiliki biaya benchmark lebih rendah di $0.033 vs $0.135. gpt-oss-120b lebih cepat di 21.61s vs 235.89s, dengan tingkat keberhasilan 39.4% vs 33.3%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-18

Model yang Dibandingkan

Peringkat
#299
Total token output
612,215
Waktu respons (rata-rata)
235.89s
Total Biaya
$0.135
Peringkat
#325
Total token output
51,664
Waktu respons (rata-rata)
21.61s
Total Biaya
$0.033
Model yang direkomendasikan gpt-oss-120b

It offers the best overall trade-off: a competitive score (3.7), lower cost than Granite 4.2 8B (high), and balanced response time.

Perbandingan terperinci

Metrik Granite 4.2 8B Granite 4.2 8B high Rilis: 2026-09-02 gpt-oss-120b gpt-oss-120b none Rilis: 2025-08-05 Tersedia gratis
Skor 4.6 3.7
Peringkat #299 #325
Keandalan 7.6 10.0
Konsistensi 6.3 7.8
Percobaan 66/66 57/66
Tes benar
Tingkat lulus per percobaan 39.4% 33.3%
Tes tidak stabil 10 2
Total Run 66 57
Biaya per hasil 2.085 0.168
Total Biaya $0.135 $0.033
Harga input $0.060 / 1M $0.150 / 1M
Harga output $0.250 / 1M $0.600 / 1M
Total token input 43,278 9,081
Token output 181,083 51,664
Token penalaran 431,132 0
Waktu respons (rata-rata) 235.89s 21.61s
Waktu respons (maks) 685.87s 113.71s
Waktu respons (total) 5189.64s 345.79s
Parameter 8B 117B total (5.1B aktif)
Ketersediaan Sumber terbuka Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#299 IBM: Granite 4.2 8B

high
Provider returned error
Biaya
$0.000
Waktu
0.2s
Token
0 tok

#325 gpt-oss-120b

none
Belum ada hasil showcase yang dihasilkan untuk model ini.
Biaya
T/A
Waktu
-
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Granite 4.2 8B 3.8 4.3 33.3% 2 515.34s 7,047 42,438 154,749
gpt-oss-120b 1.5 4.0 22.2% 1 9.57s 901 3,232 0

Perbandingan Cepat

Ganti Pasangan Perbandingan