Navigasi
Advertise here

Granite 4.2 8B vs Laguna S 2.1 (low)

Laguna S 2.1 (low) unggul dalam skor rata-rata dengan 4.6 vs 4.4. Granite 4.2 8B memiliki biaya benchmark lebih rendah di $0.037 vs $0.108. Granite 4.2 8B lebih cepat di 84.66s vs 88.24s, dengan tingkat keberhasilan 15.9% vs 23.2%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#355
Total token output
133,268
Waktu respons (rata-rata)
84.66s
Total Biaya
$0.037
Peringkat
#343
Total token output
437,706
Waktu respons (rata-rata)
88.24s
Total Biaya
$0.108
Model yang direkomendasikan Granite 4.2 8B

Its score stays close to the best score here (4.4 vs 4.6), while costing about 3.0x less than Laguna S 2.1 (low).

Perbandingan terperinci

Metrik Granite 4.2 8B Granite 4.2 8B none Rilis: 2026-09-02 Laguna S 2.1 Laguna S 2.1 low Rilis: 2026-07-21 Tersedia gratis
Skor 4.4 4.6
Peringkat #355 #343
Keandalan 9.1 10.0
Konsistensi 9.3 7.8
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 15.9% 23.2%
Tes tidak stabil 2 6
Total Run 69 69
Biaya per hasil 1.206 3.627
Total Biaya $0.037 $0.108
Harga input $0.060 / 1M $0.090 / 1M
Harga output $0.250 / 1M $0.180 / 1M
Harga baca cache $0.015 / 1M $0.009 / 1M
Harga tulis cache T/A T/A
Total token input 226,872 232,641
Token output 133,268 69,335
Token penalaran 0 426,182
Waktu respons (rata-rata) 84.66s 88.24s
Waktu respons (maks) 747.17s 814.73s
Waktu respons (total) 1947.17s 2029.57s
Parameter 8B 118B total (8B aktif)
Ketersediaan Sumber terbuka Bobot tersedia

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#355 IBM: Granite 4.2 8B

none
Provider returned error
Biaya
$0.000
Waktu
0.2s
Token
0 tok

#343 Laguna S 2.1

low
Biaya
$0.001
Waktu
6.6s
Token
1,314 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Granite 4.2 8B 5.5 10.0 33.3% 0 105.60s 8,358 47,944 0
Laguna S 2.1 3.8 7.1 22.2% 1 167.51s 7,917 58,111 119,138

Ganti Pasangan Perbandingan