Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Grok 4.6 (low) vs GLM 5.3 Flash (high)

Grok 4.6 (low) unggul dalam skor rata-rata dengan 7.4 vs 7.3. GLM 5.3 Flash (high) memiliki biaya benchmark lebih rendah di $0.029 vs $0.449. Grok 4.6 (low) lebih cepat di 14.55s vs 25.36s, dengan tingkat keberhasilan 69.7% vs 66.7%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-26

Peringkat
#97
Total token output
38,048
Waktu respons (rata-rata)
14.55s
Total Biaya
$0.449
Peringkat
#102
Total token output
78,318
Waktu respons (rata-rata)
25.36s
Total Biaya
$0.029
Model yang direkomendasikan GLM 5.3 Flash (high)

Its score stays close to the best score here (7.3 vs 7.4), while costing about 16.0x less than Grok 4.6 (low).

Perbandingan terperinci

Metrik Grok 4.6 Grok 4.6 low Rilis: 2026-08-12 GLM 5.3 Flash GLM 5.3 Flash high Rilis: 2026-08-26
Skor 7.4 7.3
Peringkat #97 #102
Keandalan 10.0 10.0
Konsistensi 9.6 8.9
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 69.7% 66.7%
Tes tidak stabil 1 3
Total Run 66 66
Biaya per hasil 2.989 0.216
Total Biaya $0.449 $0.029
Harga input $2.000 / 1M $0.075 / 1M
Harga output $6.000 / 1M $0.250 / 1M
Total token input 109,960 113,003
Token output 5,124 11,558
Token penalaran 32,924 66,760
Waktu respons (rata-rata) 14.55s 25.36s
Waktu respons (maks) 26.46s 163.41s
Waktu respons (total) 320.17s 558.01s
Parameter ~1.7T total (~170B aktif) 320B total (18B aktif)
Ketersediaan Tertutup Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 SpaceXAI: Grok 4.6

low
Biaya
$0.011
Waktu
26.0s
Token
1,941 tok

#102 GLM 5.3 Flash

high
Biaya
$0.003
Waktu
186.7s
Token
10,486 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740
GLM 5.3 Flash 8.2 7.2 88.9% 1 19.62s 7,317 373 9,973

Perbandingan Cepat

Ganti Pasangan Perbandingan