AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#276

Granite 4.2 8B

IBM Granite Rilis: 2026-09-02 Diuji pada: 2026-09-02 02:15 ibm-granite/granite-4.2-8b::high
8BPadatSumber terbuka

Ringkasan

Granite 4.2 8B mendapat skor 4.6 di AI BENCHY dan berada di peringkat #276. Model ini memiliki reliabilitas 7.6, tingkat keberhasilan 39.4%, total biaya $0.084, dan waktu respons rata-rata 235.89s.

Yang membuat Granite 4.2 8B unik: Model ini paling menonjol di Gabungan, dengan peringkat #1, sementara Parsing dan ekstraksi data adalah area terlemahnya di #10. Model ini memakai token reasoning yang sangat tinggi, yang bisa menjelaskan run yang lebih lambat atau lebih mahal.

Fakta model

Ditelaah pada 2026-09-02

Dilaporkan
Parameter
8B
Arsitektur
Padat
Ketersediaan
Sumber terbuka
Lisensi
Apache-2.0

Skor

4.6

Konsistensi

6.3

Keandalan

7.6

Total token output

612,215

Total token input

43,278

Harga input

$0.100 / 1M

Harga output

$0.150 / 1M

Tes benar

Tes Salah: 18

Tingkat lulus per percobaan: 39.4%

Tes tidak stabil

10

Tes tidak stabil memiliki hasil campuran antar run (setidaknya satu lulus dan satu gagal).

Waktu respons (rata-rata)

235.89s

Waktu respons (maks): 685.87s

Waktu respons (total): 5189.64s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#276 IBM: Granite 4.2 8B

high
Provider returned error
Biaya
$0.000
Waktu
0.2s
Token
0 tok

Grafik

Pilih model pertama, lalu klik model kedua untuk membuka halaman berdampingan.

Total token output

Skor vs Total token output

Perbandingan Cepat

Rincian Kategori

Kategori Skor Konsistensi Tes benar
Trik anti-AI 6.9 5.8
Pemrograman 3.8 4.3
Gabungan 5.0 6.8
Parsing dan ekstraksi data 3.8 5.8
Spesifik domain 2.9 7.2
Kecerdasan umum 5.5 10.0
Kepatuhan instruksi 6.4 5.8
Pemecahan teka-teki 2.9 4.4
Pemanggilan alat 10.0 10.0
Pengetahuan umum 3.0 10.0

Model yang Dibandingkan