Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

GPT 5.3 Chat (default) vs GLM 5.2

Skor rata-rata hampir imbang di 6.7 vs 6.6. GLM 5.2 memiliki biaya benchmark lebih rendah di $0.250 vs $0.533. GPT 5.3 Chat (default) lebih cepat di 6.31s vs 11.27s, dengan tingkat keberhasilan 62.3% vs 63.8%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#193
Total token output
28,179
Waktu respons (rata-rata)
6.31s
Total Biaya
$0.533
Peringkat
#198
Total token output
17,685
Waktu respons (rata-rata)
11.27s
Total Biaya
$0.250
Model yang direkomendasikan GLM 5.2

It has the best score here (6.6), while costing about 2.1x less than GPT 5.3 Chat (default).

Perbandingan terperinci

Metrik GPT 5.3 Chat GPT 5.3 Chat default Rilis: 2026-03-03 GLM 5.2 GLM 5.2 none Rilis: 2026-06-17
Skor 6.7 6.6
Peringkat #193 #198
Keandalan 10.0 10.0
Konsistensi 8.6 9.0
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 62.3% 63.8%
Tes tidak stabil 4 3
Total Run 69 69
Biaya per hasil 4.097 1.753
Total Biaya $0.533 $0.250
Harga input $1.750 / 1M $0.153 / 1M
Harga output $14.000 / 1M $12.000 / 1M
Harga baca cache T/A $0.150 / 1M
Harga tulis cache T/A T/A
Total token input 78,846 247,919
Token output 7,635 17,685
Token penalaran 20,544 0
Waktu respons (rata-rata) 6.31s 11.27s
Waktu respons (maks) 18.33s 79.65s
Waktu respons (total) 138.73s 259.32s
Parameter ~400B total (~17B aktif) 744B total (40B aktif)
Ketersediaan Tertutup Sumber terbuka

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#193 GPT 5.3 Chat

default
Biaya
$0.008
Waktu
8.1s
Token
634 tok

#198 GLM 5.2

none
Biaya
$0.033
Waktu
87.7s
Token
7,455 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 808 5,824
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

Ganti Pasangan Perbandingan