Navigasi
AI BENCHY
Advertise here

Qwen: Qwen3.6 Max Preview vs Z.ai: GLM 5.2

Qwen3.6 Max Preview (medium) unggul dalam skor rata-rata dengan 8.4 vs 8.0. GLM 5.2 (high) memiliki biaya benchmark lebih rendah di $0.296 vs $1.143. GLM 5.2 (high) lebih cepat di 62.65s vs 67.53s, dengan tingkat keberhasilan 80.3% vs 71.2%.

Model yang direkomendasikanGLM 5.2 (high)Its score stays close to the best score here (8.0 vs 8.4), while costing about 3.9x less than Qwen3.6 Max Preview (medium).

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-18

Metrik Qwen3.6 Max Preview Qwen3.6 Max Preview medium Rilis: 2026-04-20 GLM 5.2 GLM 5.2 high Rilis: 2026-06-17
Skor 8.4 8.0
Peringkat #19 #31
Keandalan 9.9 10.0
Konsistensi 8.9 8.6
Tes benar
Tingkat lulus per percobaan 80.3% 71.2%
Tes tidak stabil 3 3
Total Run 66 66
Biaya per hasil 8.173 5.873
Total Biaya $1.143 $0.296
Harga input $1.040 / 1M $0.293 / 1M
Harga output $6.240 / 1M $0.920 / 1M
Total token input 79,240 83,813
Token output 5,098 69,688
Token penalaran 164,842 225,659
Waktu respons (rata-rata) 67.53s 62.65s
Waktu respons (maks) 238.07s 599.43s
Waktu respons (total) 1485.64s 1378.34s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#19 Qwen3.6 Max Preview

medium
Biaya
$0.024
Waktu
76.5s
Token
3,861 tok

#31 GLM 5.2

high
SVG tidak valid
Biaya
$0.000
Waktu
300.0s
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Qwen3.6 Max Preview 8.8 7.8 88.9% 1 146.48s 7,895 427 52,957
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

Perbandingan Cepat

Ganti Pasangan Perbandingan