Navigasi
Advertise here

DeepSeek V4.1 Flash (medium) vs Muse Spark 1.1 (low)

DeepSeek V4.1 Flash (medium) unggul dalam skor rata-rata dengan 8.7 vs 8.6. DeepSeek V4.1 Flash (medium) memiliki biaya benchmark lebih rendah di $0.591 vs $0.885. Muse Spark 1.1 (low) lebih cepat di 13.21s vs 32.88s, dengan tingkat keberhasilan 73.9% vs 72.5%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#53
Total token output
444,665
Waktu respons (rata-rata)
32.88s
Total Biaya
$0.591
Peringkat
#61
Total token output
122,421
Waktu respons (rata-rata)
13.21s
Total Biaya
$0.885
Model yang direkomendasikan Muse Spark 1.1 (low)

Its score stays close to the best score here (8.6 vs 8.7), while responding about 2.5x faster than DeepSeek V4.1 Flash (medium).

Perbandingan terperinci

Metrik DeepSeek V4.1 Flash DeepSeek V4.1 Flash medium Rilis: 2026-09-10 Muse Spark 1.1 Muse Spark 1.1 low Rilis: 2026-07-16
Skor 8.7 8.6
Peringkat #53 #61
Keandalan 9.6 10.0
Konsistensi 9.3 8.6
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 73.9% 72.5%
Tes tidak stabil 2 4
Total Run 69 69
Biaya per hasil 1.757 6.318
Total Biaya $0.591 $0.885
Harga input $0.013 / 1M $1.250 / 1M
Harga output $1.320 / 1M $4.250 / 1M
Harga baca cache $0.013 / 1M $0.150 / 1M
Harga tulis cache T/A T/A
Total token input 280,643 291,368
Token output 7,342 13,469
Token penalaran 437,323 108,952
Waktu respons (rata-rata) 32.88s 13.21s
Waktu respons (maks) 276.31s 54.15s
Waktu respons (total) 756.34s 303.92s
Parameter 748B total (16B aktif) ~1T total (~50B aktif)
Ketersediaan Sumber terbuka Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#53 DeepSeek V4.1 Flash

medium
Biaya
$0.014
Waktu
34.7s
Token
11,541 tok

#61 Muse Spark 1.1

low
Biaya
$0.020
Waktu
39.2s
Token
4,947 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
DeepSeek V4.1 Flash 10.0 10.0 100.0% 0 34.45s 7,509 396 71,345
Muse Spark 1.1 10.0 10.0 100.0% 0 10.34s 8,562 394 14,503

Ganti Pasangan Perbandingan