Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Qwen3.8 2.4T A95B (high) vs GLM 5.3 (high)

Skor rata-rata hampir imbang di 7.9 vs 7.8. GLM 5.3 (high) memiliki biaya benchmark lebih rendah di $0.610 vs $2.949. GLM 5.3 (high) lebih cepat di 28.38s vs 120.88s, dengan tingkat keberhasilan 75.4% vs 75.4%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-03

Model yang Dibandingkan

Peringkat
#103
Total token output
468,439
Waktu respons (rata-rata)
120.88s
Total Biaya
$2.949
Peringkat
#107
Total token output
68,482
Waktu respons (rata-rata)
28.38s
Total Biaya
$0.610
Model yang direkomendasikan GLM 5.3 (high)

It has the best score here (7.8), while costing about 4.8x less than Qwen3.8 2.4T A95B (high).

Perbandingan terperinci

Metrik Qwen3.8 2.4T A95B Qwen3.8 2.4T A95B high Rilis: 2026-08-12 GLM 5.3 GLM 5.3 high Rilis: 2026-08-20
Skor 7.9 7.8
Peringkat #103 #107
Keandalan 9.6 10.0
Konsistensi 8.4 7.6
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 75.4% 75.4%
Tes tidak stabil 4 7
Total Run 69 69
Biaya per hasil 18.696 4.351
Total Biaya $2.949 $0.610
Harga input $2.000 / 1M $1.400 / 1M
Harga output $6.000 / 1M $4.400 / 1M
Harga baca cache $0.250 / 1M $0.140 / 1M
Harga tulis cache T/A T/A
Total token input 295,642 219,811
Token output 115,041 8,811
Token penalaran 353,398 59,671
Waktu respons (rata-rata) 120.88s 28.38s
Waktu respons (maks) 532.28s 159.91s
Waktu respons (total) 2780.16s 652.78s
Parameter 2.4T total (95B aktif) 744B total (40B aktif)
Ketersediaan Bobot tersedia Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#103 Qwen3.8 2.4T A95B

high
Reached the allocated time limit (600 seconds) without receiving showcase output.
Biaya
$0.000
Waktu
600.0s
Token
0 tok

#107 GLM 5.3

high
Biaya
$0.085
Waktu
362.5s
Token
19,310 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Qwen3.8 2.4T A95B 5.9 6.3 55.6% 1 160.52s 6,399 3,310 48,078
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

Perbandingan Cepat

Ganti Pasangan Perbandingan