Navigasi
Advertise here

DeepSeek V4 Flash 0423 vs Ling 3.1 Flash (low)

Skor rata-rata hampir imbang di 6.3 vs 6.3. Ling 3.1 Flash (low) memiliki biaya benchmark lebih rendah di $0.000 vs $0.018. DeepSeek V4 Flash 0423 lebih cepat di 38.64s vs 85.22s, dengan tingkat keberhasilan 30.4% vs 66.7%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-03

Model yang Dibandingkan

Peringkat
#227
Total token output
115,591
Waktu respons (rata-rata)
38.64s
Total Biaya
$0.018
Peringkat
#222
Total token output
704,170
Waktu respons (rata-rata)
85.22s
Total Biaya
$0.000
Model yang direkomendasikan Ling 3.1 Flash (low)

It has the strongest score in this comparison (6.3) and the best overall balance of cost and response time across all 2 models.

Perbandingan terperinci

Metrik DeepSeek V4 Flash 0423 DeepSeek V4 Flash 0423 none Rilis: 2026-04-24 Ling 3.1 Flash Ling 3.1 Flash low Rilis: 2026-10-03
Skor 6.3 6.3
Peringkat #227 #222
Keandalan 10.0 9.7
Konsistensi 8.6 7.8
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 30.4% 66.7%
Tes tidak stabil 4 6
Total Run 69 69
Biaya per hasil 1.220 0.000
Total Biaya $0.018 $0.000
Harga input $0.028 / 1M $0.000 / 1M
Harga output $0.056 / 1M $0.000 / 1M
Harga baca cache $0.006 / 1M T/A
Harga tulis cache T/A T/A
Total token input 403,455 271,890
Token output 115,591 190,841
Token penalaran 0 513,329
Waktu respons (rata-rata) 38.64s 85.22s
Waktu respons (maks) 247.27s 432.81s
Waktu respons (total) 888.69s 1960.12s
Parameter 284B total (13B aktif) 560B total (25B aktif)
Ketersediaan Sumber terbuka Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#227 DeepSeek V4 Flash 0423

none
Biaya
$0.004
Waktu
157.6s
Token
11,297 tok

#222 Ling 3.1 Flash

low
Biaya
$0.000
Waktu
133.5s
Token
12,950 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
DeepSeek V4 Flash 0423 4.2 7.4 11.1% 1 17.13s 7,279 9,717 0
Ling 3.1 Flash 5.6 4.2 66.7% 2 107.30s 8,298 20,816 86,330

Perbandingan Cepat

Ganti Pasangan Perbandingan