Navigasi
Advertise here

DeepSeek V4.1 Flash (low) vs Qwen3.8 Flash Next (low)

DeepSeek V4.1 Flash (low) unggul dalam skor rata-rata dengan 8.0 vs 8.0. Qwen3.8 Flash Next (low) memiliki biaya benchmark lebih rendah di ~$0.045 vs $0.526. Qwen3.8 Flash Next (low) lebih cepat di 23.66s vs 28.04s, dengan tingkat keberhasilan 73.9% vs 79.7%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-05

Model yang Dibandingkan

Peringkat
#91
Total token output
371,547
Waktu respons (rata-rata)
28.04s
Total Biaya
$0.526
Peringkat
#96
Total token output
135,295
Waktu respons (rata-rata)
23.66s
Total Biaya
~$0.045
Model yang direkomendasikan Qwen3.8 Flash Next (low)

Its score stays close to the best score here (8.0 vs 8.0), while costing about 11.7x less than DeepSeek V4.1 Flash (low).

Perbandingan terperinci

Metrik DeepSeek V4.1 Flash DeepSeek V4.1 Flash low Rilis: 2026-09-10 Qwen3.8 Flash Next Qwen3.8 Flash Next low Rilis: 2026-10-04
Skor 8.0 8.0
Peringkat #91 #96
Keandalan 9.6 10.0
Konsistensi 8.7 8.0
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 73.9% 79.7%
Tes tidak stabil 4 6
Total Run 69 69
Biaya per hasil 1.576 ~0.299
Total Biaya $0.526 ~$0.045
Harga input $0.003 / 1M T/A
Harga output $2.400 / 1M T/A
Harga baca cache $0.003 / 1M T/A
Harga tulis cache T/A T/A
Total token input 266,849 342,163
Token output 8,284 1,518
Token penalaran 363,263 133,777
Waktu respons (rata-rata) 28.04s 23.66s
Waktu respons (maks) 149.84s 166.72s
Waktu respons (total) 645.03s 544.16s
Parameter 748B total (16B aktif) 180B total (6B aktif)
Ketersediaan Sumber terbuka Bobot tersedia

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 DeepSeek V4.1 Flash

low
Biaya
$0.017
Waktu
43.6s
Token
14,069 tok

#96 Qwen3.8 Flash Next

low
Biaya
~$0.002
Waktu
47.2s
Token
5,270 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
DeepSeek V4.1 Flash 10.0 10.0 100.0% 0 40.66s 7,509 378 81,978
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 29.46s 8,127 397 24,147

Perbandingan Cepat

Ganti Pasangan Perbandingan

Gemini 3.8 FlashmediumvsQwen3.8 Flash NextlowGPT-5.4 NanomediumvsQwen3.8 Flash NextlowClaude Opus 4.7mediumvsDeepSeek V4.1 FlashlowDeepSeek V4.1 FlashlowvsGPT-5.6 LunahighQwen3.8 Flash NextlowvsGLM 5.3 FlashXmaxClaude Fable 5.1highvsQwen3.8 Flash NextlowNemotron 3 UltramediumTersedia gratisvsQwen3.8 Flash NextlowDeepSeek V4.1 FlashlowvsNemotron 3 UltramediumTersedia gratisGPT-5.4 MinimediumvsQwen3.8 Flash NextlowGPT-5.6 LunahighvsQwen3.8 Flash NextlowDeepSeek V4.1 FlashlowvsGPT-5.4 NanomediumDeepSeek V4.1 FlashlowvsGemini 3.8 Flashmedium