AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#102

GLM 5.3 Flash

Z.ai Rilis: 2026-08-26 Diuji pada: 2026-08-26 17:11 z-ai/glm-5.3-flash::high
320B total (18B aktif)MoESumber terbuka
(max) (high) (low)

Ringkasan

GLM 5.3 Flash mendapat skor 7.3 di AI BENCHY dan berada di peringkat #102. Model ini memiliki reliabilitas 10.0, tingkat keberhasilan 66.7%, total biaya $0.029, dan waktu respons rata-rata 25.36s.

Yang membuat GLM 5.3 Flash unik: Model ini paling menonjol di Kepatuhan instruksi, dengan peringkat #1, sementara Parsing dan ekstraksi data adalah area terlemahnya di #15. Total biaya benchmark-nya sangat rendah untuk kisaran skornya.

Fakta model

Ditelaah pada 2026-08-26

Dilaporkan
Parameter
320B total (18B aktif)
Arsitektur
MoE
Ketersediaan
Sumber terbuka
Lisensi
MIT

Skor

7.3

Konsistensi

8.9

Keandalan

10.0

Total token output

78,318

Total token input

113,003

Harga input

$0.075 / 1M

Harga output

$0.250 / 1M

Tes benar

Tes Salah: 9

Tingkat lulus per percobaan: 66.7%

Tes tidak stabil

3

Tes tidak stabil memiliki hasil campuran antar run (setidaknya satu lulus dan satu gagal).

Waktu respons (rata-rata)

25.36s

Waktu respons (maks): 163.41s

Waktu respons (total): 558.01s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#102 GLM 5.3 Flash

high
Biaya
$0.003
Waktu
186.7s
Token
10,486 tok

Grafik

Pilih model pertama, lalu klik model kedua untuk membuka halaman berdampingan.

Total token output

Skor vs Total token output

Perbandingan Cepat

Rincian Kategori

Kategori Skor Konsistensi Tes benar
Trik anti-AI 8.3 10.0
Pemrograman 8.2 7.2
Gabungan 6.4 5.8
Parsing dan ekstraksi data 7.3 5.8
Spesifik domain 3.0 10.0
Kecerdasan umum 5.0 10.0
Kepatuhan instruksi 10.0 10.0
Pemecahan teka-teki 10.0 10.0
Pemanggilan alat 10.0 10.0
Pengetahuan umum 3.0 10.0

Model yang Dibandingkan