Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Granite 4.2 8B (low) vs Mistral Small 4

Skor rata-rata hampir imbang di 5.1 vs 5.1. Granite 4.2 8B (low) memiliki biaya benchmark lebih rendah di $0.012 vs $0.022. Mistral Small 4 lebih cepat di 1.20s vs 54.36s, dengan tingkat keberhasilan 31.8% vs 25.8%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-02

Peringkat
#247
Total token output
27,928
Waktu respons (rata-rata)
54.36s
Total Biaya
$0.012
Peringkat
#245
Total token output
9,812
Waktu respons (rata-rata)
1.20s
Total Biaya
$0.022
Model yang direkomendasikan Mistral Small 4

It has the best score here (5.1), while responding about 45.3x faster than Granite 4.2 8B (low).

Perbandingan terperinci

Metrik Granite 4.2 8B Granite 4.2 8B low Rilis: 2026-09-02 Mistral Small 4 Mistral Small 4 none Rilis: 2026-03-16
Skor 5.1 5.1
Peringkat #247 #245
Keandalan 9.0 10.0
Konsistensi 10.0 9.6
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 31.8% 25.8%
Tes tidak stabil 0 1
Total Run 66 66
Biaya per hasil 0.167 0.432
Total Biaya $0.012 $0.022
Harga input $0.100 / 1M $0.150 / 1M
Harga output $0.150 / 1M $0.600 / 1M
Total token input 74,721 104,717
Token output 9,205 9,812
Token penalaran 18,723 0
Waktu respons (rata-rata) 54.36s 1.20s
Waktu respons (maks) 566.80s 13.16s
Waktu respons (total) 1195.97s 26.41s
Parameter 8B 119B total (6B aktif)
Ketersediaan Sumber terbuka Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#247 IBM: Granite 4.2 8B

low
Provider returned error
Biaya
$0.000
Waktu
0.2s
Token
0 tok

#245 Mistral Small 4

none
Biaya
$0.002
Waktu
10.4s
Token
2,370 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Granite 4.2 8B 5.5 10.0 33.3% 0 13.01s 8,439 2,469 2,984
Mistral Small 4 3.7 9.7 0.0% 0 901ms 7,636 619 0

Perbandingan Cepat

Ganti Pasangan Perbandingan