Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.7 Plus (medium) vs GLM 5.2 (high)

GLM 5.2 (high) unggul dalam skor rata-rata dengan 8.0 vs 7.9. Qwen3.7 Plus (medium) memiliki biaya benchmark lebih rendah di $0.277 vs $1.188. Qwen3.7 Plus (medium) lebih cepat di 53.51s vs 69.86s, dengan tingkat keberhasilan 75.8% vs 69.7%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-20

Peringkat
#62
Total token output
187,337
Waktu respons (rata-rata)
53.51s
Total Biaya
$0.277
Peringkat
#55
Total token output
364,655
Waktu respons (rata-rata)
69.86s
Total Biaya
$1.188
Model yang direkomendasikan Qwen3.7 Plus (medium)

Its score stays close to the best score here (7.9 vs 8.0), while costing about 4.3x less than GLM 5.2 (high).

Perbandingan terperinci

Metrik Qwen3.7 Plus Qwen3.7 Plus medium Rilis: 2026-06-03 GLM 5.2 GLM 5.2 high Rilis: 2026-06-17
Skor 7.9 8.0
Peringkat #62 #55
Keandalan 10.0 10.0
Konsistensi 8.9 8.6
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 75.8% 69.7%
Tes tidak stabil 3 3
Total Run 66 66
Biaya per hasil 2.134 6.849
Total Biaya $0.277 $1.188
Harga input $0.320 / 1M $0.966 / 1M
Harga output $1.280 / 1M $3.036 / 1M
Total token input 115,242 83,822
Token output 6,163 72,040
Token penalaran 181,174 292,615
Waktu respons (rata-rata) 53.51s 69.86s
Waktu respons (maks) 315.30s 599.43s
Waktu respons (total) 1177.25s 1536.98s
Parameter ~397B total (~17B aktif) 744B total (40B aktif)
Ketersediaan Tertutup Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#62 Qwen3.7 Plus

medium
Biaya
$0.018
Waktu
193.2s
Token
10,821 tok

#55 GLM 5.2

high
SVG tidak valid
Biaya
$0.000
Waktu
300.0s
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Qwen3.7 Plus 6.1 6.6 55.6% 1 108.60s 6,472 414 43,576
GLM 5.2 6.4 8.6 33.3% 0 73.03s 5,124 2,302 22,546

Perbandingan Cepat

Ganti Pasangan Perbandingan