Navigasi
AI BENCHY
Advertise here

Qwen3.7 Max vs GLM 5 (medium)

GLM 5 (medium) unggul dalam skor rata-rata dengan 7.7 vs 7.4. Qwen3.7 Max memiliki biaya benchmark lebih rendah di $0.197 vs $0.307. Qwen3.7 Max lebih cepat di 4.52s vs 33.54s, dengan tingkat keberhasilan 68.2% vs 78.8%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-25

Peringkat
#67
Total token output
12,446
Waktu respons (rata-rata)
4.52s
Total Biaya
$0.197
Peringkat
#49
Total token output
124,566
Waktu respons (rata-rata)
33.54s
Total Biaya
$0.307
Model yang direkomendasikan Qwen3.7 Max

Its score stays close to the best score here (7.4 vs 7.7), while costing about 1.6x less than GLM 5 (medium).

Perbandingan terperinci

Metrik Qwen3.7 Max Qwen3.7 Max none Rilis: 2026-05-22 GLM 5 GLM 5 medium Rilis: 2026-02-12
Skor 7.4 7.7
Peringkat #67 #49
Keandalan 9.9 10.0
Konsistensi 10.0 8.1
Tes benar
Tingkat lulus per percobaan 68.2% 78.8%
Tes tidak stabil 0 4
Total Run 66 63
Biaya per hasil 1.582 1.668
Total Biaya $0.197 $0.307
Harga input $1.475 / 1M $0.950 / 1M
Harga output $4.425 / 1M $2.551 / 1M
Total token input 95,983 35,224
Token output 12,446 21,570
Token penalaran 0 102,996
Waktu respons (rata-rata) 4.52s 33.54s
Waktu respons (maks) 72.30s 99.85s
Waktu respons (total) 99.52s 435.99s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#67 Qwen3.7 Max

none
Biaya
$0.046
Waktu
195.0s
Token
12,171 tok

#49 GLM 5

medium
Biaya
$0.005
Waktu
20.7s
Token
2,068 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Qwen3.7 Max 5.5 10.0 33.3% 0 1.35s 7,911 582 0
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930

Perbandingan Cepat

Ganti Pasangan Perbandingan