Navigasi
Advertise here

DeepSeek V4 Flash 0731 (medium) vs GLM 5.3 (high)

GLM 5.3 (high) unggul dalam skor rata-rata dengan 7.8 vs 7.8. DeepSeek V4 Flash 0731 (medium) memiliki biaya benchmark lebih rendah di $0.464 vs $0.610. GLM 5.3 (high) lebih cepat di 28.38s vs 94.16s, dengan tingkat keberhasilan 72.5% vs 75.4%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-03

Model yang Dibandingkan

Peringkat
#112
Total token output
577,214
Waktu respons (rata-rata)
94.16s
Total Biaya
$0.464
Peringkat
#107
Total token output
68,482
Waktu respons (rata-rata)
28.38s
Total Biaya
$0.610
Model yang direkomendasikan GLM 5.3 (high)

It has the best score here (7.8), while responding about 3.3x faster than DeepSeek V4 Flash 0731 (medium).

Perbandingan terperinci

Metrik DeepSeek V4 Flash 0731 DeepSeek V4 Flash 0731 medium Rilis: 2026-08-01 GLM 5.3 GLM 5.3 high Rilis: 2026-08-20
Skor 7.8 7.8
Peringkat #112 #107
Keandalan 10.0 10.0
Konsistensi 7.2 7.6
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 72.5% 75.4%
Tes tidak stabil 8 7
Total Run 69 69
Biaya per hasil 1.176 4.351
Total Biaya $0.464 $0.610
Harga input $0.018 / 1M $1.400 / 1M
Harga output $1.280 / 1M $4.400 / 1M
Harga baca cache $0.018 / 1M $0.140 / 1M
Harga tulis cache T/A T/A
Total token input 274,189 219,811
Token output 66,689 8,811
Token penalaran 510,525 59,671
Waktu respons (rata-rata) 94.16s 28.38s
Waktu respons (maks) 303.26s 159.91s
Waktu respons (total) 2165.72s 652.78s
Parameter 284B total (13B aktif) 744B total (40B aktif)
Ketersediaan Tertutup Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#112 DeepSeek V4 Flash 0731

medium
Biaya
$0.004
Waktu
93.3s
Token
13,252 tok

#107 GLM 5.3

high
Biaya
$0.085
Waktu
362.5s
Token
19,310 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
DeepSeek V4 Flash 0731 6.4 4.4 77.8% 2 198.78s 6,032 4,109 160,154
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

Perbandingan Cepat

Ganti Pasangan Perbandingan