Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Claude Sonnet 4.6 vs GLM 5.3 (high)

Skor rata-rata hampir imbang di 7.3 vs 7.3. GLM 5.3 (high) memiliki biaya benchmark lebih rendah di $0.403 vs $0.661. Claude Sonnet 4.6 lebih cepat di 7.67s vs 27.82s, dengan tingkat keberhasilan 57.6% vs 74.2%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-20

Peringkat
#98
Total token output
19,362
Waktu respons (rata-rata)
7.67s
Total Biaya
$0.661
Peringkat
#99
Total token output
63,667
Waktu respons (rata-rata)
27.82s
Total Biaya
$0.403
Model yang direkomendasikan Claude Sonnet 4.6

It has the best score here (7.3), while responding about 3.6x faster than GLM 5.3 (high).

Perbandingan terperinci

Metrik Claude Sonnet 4.6 Claude Sonnet 4.6 none Rilis: 2026-02-17 GLM 5.3 GLM 5.3 high Rilis: 2026-08-20
Skor 7.3 7.3
Peringkat #98 #99
Keandalan 10.0 10.0
Konsistensi 9.7 7.5
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 57.6% 74.2%
Tes tidak stabil 1 7
Total Run 66 66
Biaya per hasil 5.503 3.099
Total Biaya $0.661 $0.403
Harga input $3.000 / 1M $1.400 / 1M
Harga output $15.000 / 1M $4.400 / 1M
Total token input 123,273 87,601
Token output 19,362 6,006
Token penalaran 0 57,661
Waktu respons (rata-rata) 7.67s 27.82s
Waktu respons (maks) 51.18s 159.91s
Waktu respons (total) 122.78s 612.06s
Parameter ~1T total (~100B aktif) 744B total (40B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#98 Claude Sonnet 4.6

none
Biaya
$0.038
Waktu
27.3s
Token
2,598 tok

#99 GLM 5.3

high
Biaya
$0.085
Waktu
362.5s
Token
19,310 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

Perbandingan Cepat

Ganti Pasangan Perbandingan