Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Muse Spark 1.2 (medium) vs Qwen3.8 Max (low)

Skor rata-rata hampir imbang di 8.6 vs 8.7. Qwen3.8 Max (low) memiliki biaya benchmark lebih rendah di $0.687 vs $1.227. Muse Spark 1.2 (medium) lebih cepat di 17.47s vs 21.19s, dengan tingkat keberhasilan 74.2% vs 84.9%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-05

Peringkat
#25
Total token output
252,312
Waktu respons (rata-rata)
17.47s
Total Biaya
$1.227
Peringkat
#24
Total token output
81,411
Waktu respons (rata-rata)
21.19s
Total Biaya
$0.687
Model yang direkomendasikan Qwen3.8 Max (low)

It has the best score here (8.7), while costing about 1.8x less than Muse Spark 1.2 (medium).

Perbandingan terperinci

Metrik Muse Spark 1.2 Muse Spark 1.2 medium Rilis: 2026-08-06 Qwen3.8 Max Qwen3.8 Max low Rilis: 2026-08-04
Skor 8.6 8.7
Peringkat #25 #24
Keandalan 9.9 10.0
Konsistensi 8.7 9.0
Cakupan benchmark 22/22 tes · 66/66 percobaan 22/22 tes · 66/66 percobaan
Tes benar
Tingkat lulus per percobaan 74.2% 84.9%
Tes tidak stabil 4 3
Total Run 66 66
Biaya per hasil 8.764 4.041
Total Biaya $1.227 $0.687
Harga input $1.250 / 1M $2.000 / 1M
Harga output $4.250 / 1M $6.000 / 1M
Total token input 123,671 99,172
Token output 7,222 6,132
Token penalaran 245,090 75,279
Waktu respons (rata-rata) 17.47s 21.19s
Waktu respons (maks) 142.49s 155.75s
Waktu respons (total) 384.44s 466.14s

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Muse Spark 1.2

medium
Biaya
$0.033
Waktu
21.8s
Token
7,846 tok

#24 Qwen3.8 Max

low
Biaya
$0.026
Waktu
68.5s
Token
4,280 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Muse Spark 1.2 10.0 10.0 100.0% 0 17.49s 7,275 353 33,215
Qwen3.8 Max 8.4 7.4 88.9% 1 28.69s 8,127 512 15,952

Perbandingan Cepat

Ganti Pasangan Perbandingan