Navigasi
Advertise here

Granite 4.2 8B (low) vs Ling 3.1 Flash

Ling 3.1 Flash unggul dalam skor rata-rata dengan 5.5 vs 5.3. Ling 3.1 Flash memiliki biaya benchmark lebih rendah di $0.000 vs $0.036. Ling 3.1 Flash lebih cepat di 15.75s vs 58.20s, dengan tingkat keberhasilan 33.3% vs 33.3%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-03

Model yang Dibandingkan

Peringkat
#287
Total token output
61,351
Waktu respons (rata-rata)
58.20s
Total Biaya
$0.036
Peringkat
#272
Total token output
85,777
Waktu respons (rata-rata)
15.75s
Total Biaya
$0.000
Model yang direkomendasikan Ling 3.1 Flash

It has the best score here (5.5), while responding about 3.7x faster than Granite 4.2 8B (low).

Perbandingan terperinci

Metrik Granite 4.2 8B Granite 4.2 8B low Rilis: 2026-09-02 Ling 3.1 Flash Ling 3.1 Flash none Rilis: 2026-10-03
Skor 5.3 5.5
Peringkat #287 #272
Keandalan 9.2 9.8
Konsistensi 9.7 8.4
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 33.3% 33.3%
Tes tidak stabil 1 5
Total Run 69 69
Biaya per hasil 0.508 0.000
Total Biaya $0.036 $0.000
Harga input $0.060 / 1M $0.000 / 1M
Harga output $0.250 / 1M $0.000 / 1M
Harga baca cache $0.015 / 1M T/A
Harga tulis cache T/A T/A
Total token input 332,917 286,758
Token output 18,989 85,777
Token penalaran 42,362 0
Waktu respons (rata-rata) 58.20s 15.75s
Waktu respons (maks) 566.80s 90.95s
Waktu respons (total) 1338.65s 362.23s
Parameter 8B 560B total (25B aktif)
Ketersediaan Sumber terbuka Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#287 IBM: Granite 4.2 8B

low
Provider returned error
Biaya
$0.000
Waktu
0.2s
Token
0 tok

#272 Ling 3.1 Flash

none
Biaya
$0.000
Waktu
171.4s
Token
20,178 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Granite 4.2 8B 5.5 10.0 33.3% 0 13.01s 8,439 2,469 2,984
Ling 3.1 Flash 4.5 7.5 22.2% 1 31.85s 8,307 27,810 0

Perbandingan Cepat

Ganti Pasangan Perbandingan