Navigasi
Advertise here

Qwen3.6 Max Preview vs GLM 5.3 FlashX (medium)

Skor rata-rata hampir imbang di 6.4 vs 6.4. GLM 5.3 FlashX (medium) memiliki biaya benchmark lebih rendah di $0.056 vs $0.228. GLM 5.3 FlashX (medium) lebih cepat di 4.32s vs 7.82s, dengan tingkat keberhasilan 56.1% vs 68.2%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-21

Model yang Dibandingkan

Peringkat
#191
Total token output
19,257
Waktu respons (rata-rata)
7.82s
Total Biaya
$0.228
Peringkat
#194
Total token output
19,433
Waktu respons (rata-rata)
4.32s
Total Biaya
$0.056
Model yang direkomendasikan GLM 5.3 FlashX (medium)

It has the best score here (6.4), while costing about 4.1x less than Qwen3.6 Max Preview.

Perbandingan terperinci

Metrik Qwen3.6 Max Preview Qwen3.6 Max Preview none Rilis: 2026-04-20 GLM 5.3 FlashX GLM 5.3 FlashX medium Rilis: 2026-09-21
Skor 6.4 6.4
Peringkat #191 #194
Keandalan 9.9 10.0
Konsistensi 9.3 7.0
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 56.1% 68.2%
Tes tidak stabil 2 8
Total Run 66 66
Biaya per hasil 2.248 0.505
Total Biaya $0.228 $0.056
Harga input $1.028 / 1M $0.370 / 1M
Harga output $6.162 / 1M $1.250 / 1M
Total token input 106,348 84,329
Token output 19,257 7,717
Token penalaran 0 11,716
Waktu respons (rata-rata) 7.82s 4.32s
Waktu respons (maks) 102.62s 22.89s
Waktu respons (total) 172.04s 95.15s
Parameter ~1T total (~40B aktif) 320B total (18B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#191 Qwen3.6 Max Preview

none
Biaya
$0.025
Waktu
83.9s
Token
4,066 tok

#194 GLM 5.3 FlashX

medium
Biaya
$0.002
Waktu
8.1s
Token
1,480 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Qwen3.6 Max Preview 3.8 7.3 22.2% 1 3.12s 7,913 456 0
GLM 5.3 FlashX 6.0 4.6 66.7% 2 6.37s 7,317 384 5,562

Perbandingan Cepat

Ganti Pasangan Perbandingan