Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

DeepSeek V4 Flash (high) vs Qwen3.6 Plus (medium)

Qwen3.6 Plus (medium) unggul dalam skor rata-rata dengan 7.8 vs 7.7. DeepSeek V4 Flash (high) memiliki biaya benchmark lebih rendah di $0.060 vs $0.405. Qwen3.6 Plus (medium) lebih cepat di 43.12s vs 49.75s, dengan tingkat keberhasilan 72.7% vs 71.2%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-01

Peringkat
#57
Total token output
168,165
Waktu respons (rata-rata)
49.75s
Total Biaya
$0.060
Peringkat
#48
Total token output
191,237
Waktu respons (rata-rata)
43.12s
Total Biaya
$0.405
Model yang direkomendasikan DeepSeek V4 Flash (high)

Its score stays close to the best score here (7.7 vs 7.8), while costing about 6.8x less than Qwen3.6 Plus (medium).

Perbandingan terperinci

Metrik DeepSeek V4 Flash DeepSeek V4 Flash high Rilis: 2026-04-24 Qwen3.6 Plus Qwen3.6 Plus medium Rilis: 2026-04-20
Skor 7.7 7.8
Peringkat #57 #48
Keandalan 10.0 10.0
Konsistensi 8.2 9.3
Tes benar
Tingkat lulus per percobaan 72.7% 71.2%
Tes tidak stabil 5 2
Total Run 66 66
Biaya per hasil 0.402 1.514
Total Biaya $0.060 $0.405
Harga input $0.140 / 1M $0.325 / 1M
Harga output $0.280 / 1M $1.950 / 1M
Total token input 108,392 97,689
Token output 14,478 6,412
Token penalaran 153,687 184,825
Waktu respons (rata-rata) 49.75s 43.12s
Waktu respons (maks) 218.13s 291.55s
Waktu respons (total) 1094.41s 905.53s

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#57 DeepSeek V4 Flash

high
Biaya
$0.003
Waktu
93.1s
Token
7,926 tok

#48 Qwen3.6 Plus

medium
Biaya
$0.024
Waktu
219.0s
Token
12,235 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
DeepSeek V4 Flash 7.8 10.0 66.7% 0 50.60s 7,279 395 34,862
Qwen3.6 Plus 6.1 7.8 44.4% 1 153.12s 7,098 58 50,586

Perbandingan Cepat

Ganti Pasangan Perbandingan