Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Anthropic: Claude Sonnet 4.6 vs Z.ai: GLM 5.2

Claude Sonnet 4.6 unggul dalam skor rata-rata dengan 7.3 vs 6.6. GLM 5.2 memiliki biaya benchmark lebih rendah di $0.125 vs $0.661. Claude Sonnet 4.6 lebih cepat di 8.12s vs 9.34s, dengan tingkat keberhasilan 57.6% vs 59.1%.

Model yang direkomendasikanGLM 5.2Its score stays close to the best score here (6.6 vs 7.3), while costing about 5.3x less than Claude Sonnet 4.6.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-07-25

Metrik Claude Sonnet 4.6 Claude Sonnet 4.6 none Rilis: 2026-02-17 GLM 5.2 GLM 5.2 none Rilis: 2026-06-17
Skor 7.3 6.6
Peringkat #71 #105
Keandalan 10.0 10.0
Konsistensi 9.7 9.2
Tes benar
Tingkat lulus per percobaan 57.6% 59.1%
Tes tidak stabil 1 2
Total Run 66 64
Biaya per hasil 5.502 1.421
Total Biaya $0.661 $0.125
Harga input $3.000 / 1M $0.793 / 1M
Harga output $15.000 / 1M $2.491 / 1M
Total token input 123,264 112,359
Token output 19,362 14,340
Token penalaran 0 0
Waktu respons (rata-rata) 8.12s 9.34s
Waktu respons (maks) 51.18s 79.65s
Waktu respons (total) 121.78s 205.46s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#71 Claude Sonnet 4.6

none
Biaya
$0.038
Waktu
27.3s
Token
2,598 tok

#105 GLM 5.2

none
SVG tidak valid
Biaya
$0.033
Waktu
87.7s
Token
7,455 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Claude Sonnet 4.6 5.5 10.0 33.3% 0 5.19s 8,522 2,127 0
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

Perbandingan Cepat

Ganti Pasangan Perbandingan