Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Gemma 4 31B vs GPT-5.4 Mini

Skor rata-rata hampir imbang di 5.7 vs 5.7. Gemma 4 31B memiliki biaya benchmark lebih rendah di $0.031 vs $0.170. GPT-5.4 Mini lebih cepat di 3.34s vs 7.28s, dengan tingkat keberhasilan 42.0% vs 30.4%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-01

Model yang Dibandingkan

Peringkat
#258
Total token output
15,499
Waktu respons (rata-rata)
7.28s
Total Biaya
$0.031
Peringkat
#255
Total token output
8,828
Waktu respons (rata-rata)
3.34s
Total Biaya
$0.170
Model yang direkomendasikan Gemma 4 31B

It has the best score here (5.7), while costing about 5.5x less than GPT-5.4 Mini.

Perbandingan terperinci

Metrik Gemma 4 31B Gemma 4 31B none Rilis: 2026-04-02 Tersedia gratis GPT-5.4 Mini GPT-5.4 Mini none Rilis: 2026-03-17
Skor 5.7 5.7
Peringkat #258 #255
Keandalan 10.0 10.0
Konsistensi 9.6 9.3
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 42.0% 30.4%
Tes tidak stabil 1 2
Total Run 69 69
Biaya per hasil 0.520 2.818
Total Biaya $0.031 $0.170
Harga input $0.090 / 1M $0.750 / 1M
Harga output $0.340 / 1M $4.500 / 1M
Harga baca cache $0.050 / 1M $0.075 / 1M
Harga tulis cache T/A T/A
Total token input 270,970 172,438
Token output 15,499 8,828
Token penalaran 0 0
Waktu respons (rata-rata) 7.28s 3.34s
Waktu respons (maks) 44.73s 41.98s
Waktu respons (total) 152.84s 76.84s
Parameter 30.7B ~400B total (~17B aktif)
Ketersediaan Sumber terbuka Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#258 Gemma 4 31B

none
Biaya
$0.001
Waktu
12.8s
Token
795 tok

#255 GPT-5.4 Mini

none
Biaya
$0.010
Waktu
11.7s
Token
2,151 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemma 4 31B 5.5 10.0 33.3% 0 11.19s 8,381 735 0
GPT-5.4 Mini 5.5 10.0 33.3% 0 913ms 7,305 401 0

Perbandingan Cepat

Ganti Pasangan Perbandingan