Navigasi
AI BENCHY
Advertise here

Qwen3.7 Plus vs GLM 5.1 (medium)

Skor rata-rata hampir imbang di 7.2 vs 7.1. Qwen3.7 Plus memiliki biaya benchmark lebih rendah di $0.106 vs $0.535. Qwen3.7 Plus lebih cepat di 12.09s vs 46.77s, dengan tingkat keberhasilan 50.0% vs 69.7%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-25

Peringkat
#79
Total token output
58,097
Waktu respons (rata-rata)
12.09s
Total Biaya
$0.106
Peringkat
#82
Total token output
152,552
Waktu respons (rata-rata)
46.77s
Total Biaya
$0.535
Model yang direkomendasikan Qwen3.7 Plus

It has the best score here (7.2), while costing about 5.0x less than GLM 5.1 (medium).

Perbandingan terperinci

Metrik Qwen3.7 Plus Qwen3.7 Plus none Rilis: 2026-06-03 GLM 5.1 GLM 5.1 medium Rilis: 2026-04-07
Skor 7.2 7.1
Peringkat #79 #82
Keandalan 10.0 8.3
Konsistensi 10.0 8.4
Tes benar
Tingkat lulus per percobaan 50.0% 69.7%
Tes tidak stabil 0 4
Total Run 66 66
Biaya per hasil 1.014 4.202
Total Biaya $0.106 $0.535
Harga input $0.320 / 1M $0.966 / 1M
Harga output $1.280 / 1M $3.036 / 1M
Total token input 98,824 82,623
Token output 58,097 16,089
Token penalaran 0 136,463
Waktu respons (rata-rata) 12.09s 46.77s
Waktu respons (maks) 206.03s 308.75s
Waktu respons (total) 265.89s 982.16s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#79 Qwen3.7 Plus

none
Biaya
$0.019
Waktu
213.5s
Token
11,960 tok

#82 GLM 5.1

medium
SVG tidak valid
Biaya
$0.000
Waktu
300.0s
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Qwen3.7 Plus 5.5 10.0 33.3% 0 2.15s 7,911 639 0
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

Perbandingan Cepat

Ganti Pasangan Perbandingan