Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Muse Spark 1.1 (high) vs GPT-5 Mini (medium)

Skor rata-rata hampir imbang di 8.0 vs 8.1. GPT-5 Mini (medium) memiliki biaya benchmark lebih rendah di $0.241 vs $1.709. GPT-5 Mini (medium) lebih cepat di 27.64s vs 30.84s, dengan tingkat keberhasilan 68.2% vs 65.2%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-29

Peringkat
#53
Total token output
363,989
Waktu respons (rata-rata)
30.84s
Total Biaya
$1.709
Peringkat
#50
Total token output
108,019
Waktu respons (rata-rata)
27.64s
Total Biaya
$0.241
Model yang direkomendasikan GPT-5 Mini (medium)

It has the best score here (8.1), while costing about 7.1x less than Muse Spark 1.1 (high).

Perbandingan terperinci

Metrik Muse Spark 1.1 Muse Spark 1.1 high Rilis: 2026-07-16 GPT-5 Mini GPT-5 Mini medium Rilis: 2025-08-07
Skor 8.0 8.1
Peringkat #53 #50
Keandalan 10.0 10.0
Konsistensi 7.9 8.4
Percobaan 64/66 66/66
Tes benar
Tingkat lulus per percobaan 68.2% 65.2%
Tes tidak stabil 6 4
Total Run 64 66
Biaya per hasil 14.236 2.006
Total Biaya $1.709 $0.241
Harga input $1.250 / 1M $0.250 / 1M
Harga output $4.250 / 1M $2.000 / 1M
Total token input 129,003 98,383
Token output 8,340 14,409
Token penalaran 355,649 93,610
Waktu respons (rata-rata) 30.84s 27.64s
Waktu respons (maks) 196.03s 111.48s
Waktu respons (total) 647.67s 608.02s
Parameter ~1T total (~50B aktif) ~400B total (~17B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#53 Muse Spark 1.1

high
Biaya
$0.039
Waktu
50.1s
Token
9,423 tok

#50 GPT-5 Mini

medium
Biaya
$0.007
Waktu
42.9s
Token
3,432 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Muse Spark 1.1 10.0 10.0 100.0% 0 22.92s 8,562 349 36,039
GPT-5 Mini 10.0 10.0 100.0% 0 27.63s 7,302 658 17,152

Perbandingan Cepat

Ganti Pasangan Perbandingan