Navigasi
AI BENCHY
Advertise here

Qwen3.8 Max (0902) (medium) vs GLM 5.3 Flash (max)

Qwen3.8 Max (0902) (medium) unggul dalam skor rata-rata dengan 8.8 vs 8.7. GLM 5.3 Flash (max) memiliki biaya benchmark lebih rendah di $0.059 vs $0.677. Qwen3.8 Max (0902) (medium) lebih cepat di 26.01s vs 52.10s, dengan tingkat keberhasilan 83.3% vs 81.8%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-07

Peringkat
#36
Total token output
80,678
Waktu respons (rata-rata)
26.01s
Total Biaya
$0.677
Peringkat
#42
Total token output
204,340
Waktu respons (rata-rata)
52.10s
Total Biaya
$0.059
Model yang direkomendasikan GLM 5.3 Flash (max)

Its score stays close to the best score here (8.7 vs 8.8), while costing about 11.6x less than Qwen3.8 Max (0902) (medium).

Perbandingan terperinci

Metrik Qwen3.8 Max (0902) Qwen3.8 Max (0902) medium Rilis: 2026-09-07 GLM 5.3 Flash GLM 5.3 Flash max Rilis: 2026-08-26
Skor 8.8 8.7
Peringkat #36 #42
Keandalan 10.0 10.0
Konsistensi 9.3 8.9
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 83.3% 81.8%
Tes tidak stabil 2 3
Total Run 66 66
Biaya per hasil 3.981 0.365
Total Biaya $0.677 $0.059
Harga input $2.000 / 1M $0.075 / 1M
Harga output $6.000 / 1M $0.250 / 1M
Total token input 96,323 96,873
Token output 5,961 7,637
Token penalaran 74,717 196,703
Waktu respons (rata-rata) 26.01s 52.10s
Waktu respons (maks) 168.09s 333.47s
Waktu respons (total) 572.19s 1146.24s
Parameter 2.4T total (~100B aktif) 320B total (18B aktif)
Ketersediaan Tertutup Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#36 Qwen3.8 Max (0902)

medium
Biaya
$0.036
Waktu
108.3s
Token
5,980 tok

#42 GLM 5.3 Flash

max
Biaya
$0.005
Waktu
296.5s
Token
16,250 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Qwen3.8 Max (0902) 8.4 7.4 88.9% 1 45.74s 7,893 551 20,628
GLM 5.3 Flash 10.0 10.0 100.0% 0 43.37s 7,317 381 23,692

Perbandingan Cepat

Ganti Pasangan Perbandingan