Navigasi
Advertise here

Muse Glimmer 30B (low) vs GPT-5.6 Luna (low)

Muse Glimmer 30B (low) unggul dalam skor rata-rata dengan 6.9 vs 6.9. GPT-5.6 Luna (low) memiliki biaya benchmark lebih rendah di $0.049 vs $0.219. GPT-5.6 Luna (low) lebih cepat di 6.96s vs 22.40s, dengan tingkat keberhasilan 63.8% vs 56.5%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#172
Total token output
105,320
Waktu respons (rata-rata)
22.40s
Total Biaya
$0.219
Peringkat
#176
Total token output
28,001
Waktu respons (rata-rata)
6.96s
Total Biaya
$0.049
Model yang direkomendasikan GPT-5.6 Luna (low)

Its score stays close to the best score here (6.9 vs 6.9), while costing about 4.5x less than Muse Glimmer 30B (low).

Perbandingan terperinci

Metrik Muse Glimmer 30B Muse Glimmer 30B low Rilis: 2026-08-11 GPT-5.6 Luna GPT-5.6 Luna low Rilis: 2026-07-09
Skor 6.9 6.9
Peringkat #172 #176
Keandalan 10.0 10.0
Konsistensi 8.0 8.3
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 63.8% 56.5%
Tes tidak stabil 6 5
Total Run 69 69
Biaya per hasil 2.414 2.428
Total Biaya $0.219 $0.049
Harga input $0.300 / 1M $0.200 / 1M
Harga output $1.200 / 1M $1.200 / 1M
Harga baca cache $0.040 / 1M $0.020 / 1M
Harga tulis cache T/A $0.250 / 1M
Total token input 307,228 202,680
Token output 36,044 9,230
Token penalaran 71,621 18,771
Waktu respons (rata-rata) 22.40s 6.96s
Waktu respons (maks) 234.92s 45.74s
Waktu respons (total) 515.14s 160.19s
Parameter 30B ~400B total (~17B aktif)
Ketersediaan Sumber terbuka Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#172 Muse Glimmer 30B

low
Biaya
$0.002
Waktu
13.5s
Token
953 tok

#176 GPT-5.6 Luna

low
Biaya
$0.011
Waktu
10.2s
Token
1,897 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Muse Glimmer 30B 8.1 9.9 66.7% 0 16.52s 7,419 2,759 10,173
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

Ganti Pasangan Perbandingan