Navigasi
Advertise here

DeepSeek V4 Flash 0423 (high) vs Qwen3.6 Plus (medium)

DeepSeek V4 Flash 0423 (high) unggul dalam skor rata-rata dengan 8.1 vs 7.3. DeepSeek V4 Flash 0423 (high) memiliki biaya benchmark lebih rendah di $0.030 vs $0.554. DeepSeek V4 Flash 0423 (high) lebih cepat di 55.99s vs 57.41s, dengan tingkat keberhasilan 71.0% vs 69.6%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-01

Model yang Dibandingkan

Peringkat
#89
Total token output
234,594
Waktu respons (rata-rata)
55.99s
Total Biaya
$0.030
Peringkat
#137
Total token output
246,790
Waktu respons (rata-rata)
57.41s
Total Biaya
$0.554
Model yang direkomendasikan DeepSeek V4 Flash 0423 (high)

It has the best score here (8.1), while costing about 18.8x less than Qwen3.6 Plus (medium).

Perbandingan terperinci

Metrik DeepSeek V4 Flash 0423 DeepSeek V4 Flash 0423 high Rilis: 2026-04-24 Qwen3.6 Plus Qwen3.6 Plus medium Rilis: 2026-04-20
Skor 8.1 7.3
Peringkat #89 #137
Keandalan 10.0 10.0
Konsistensi 8.6 9.0
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 71.0% 69.6%
Tes tidak stabil 4 3
Total Run 69 69
Biaya per hasil 0.547 2.605
Total Biaya $0.030 $0.554
Harga input $0.042 / 1M $0.325 / 1M
Harga output $0.084 / 1M $1.950 / 1M
Harga baca cache $0.009 / 1M T/A
Harga tulis cache T/A $0.407 / 1M
Total token input 298,794 222,601
Token output 45,873 8,185
Token penalaran 188,721 238,605
Waktu respons (rata-rata) 55.99s 57.41s
Waktu respons (maks) 218.13s 307.08s
Waktu respons (total) 1287.87s 1263.02s
Parameter 284B total (13B aktif) ~397B total (~17B aktif)
Ketersediaan Sumber terbuka Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#89 DeepSeek V4 Flash 0423

high
Biaya
$0.003
Waktu
93.1s
Token
7,926 tok

#137 Qwen3.6 Plus

medium
Biaya
$0.024
Waktu
219.0s
Token
12,235 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
DeepSeek V4 Flash 0423 7.8 10.0 66.7% 0 50.60s 7,279 395 34,862
Qwen3.6 Plus 6.1 7.8 44.4% 1 153.12s 7,098 58 50,586

Perbandingan Cepat

Ganti Pasangan Perbandingan