Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Model yang Dibandingkan

Perbandingan benchmark GLM 5 (medium) vs GLM 5.1 (medium) vs Kimi K2.5 (medium) vs Qwen3.6 Plus Preview (medium): GLM 5 (medium) unggul pada Skor dengan 7.7. GLM 5 (medium) unggul pada Keandalan dengan 10.0. Qwen3.6 Plus Preview (medium) memiliki Total Biaya terendah di $0.000. Qwen3.6 Plus Preview (medium) paling cepat di 15.25s.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-10

Model yang Dibandingkan

Peringkat
#92
Total token output
124,566
Waktu respons (rata-rata)
33.54s
Total Biaya
$0.228
Peringkat
#142
Total token output
215,889
Waktu respons (rata-rata)
58.80s
Total Biaya
$0.727
Peringkat
#147
Total token output
220,942
Waktu respons (rata-rata)
98.19s
Total Biaya
$0.479
Peringkat
#280
Total token output
63,350
Waktu respons (rata-rata)
15.25s
Total Biaya
$0.000
Model yang direkomendasikan GLM 5 (medium)

It has the best score here (7.7), while costing about 2.7x less than model lain dalam perbandingan ini.

Perbandingan terperinci

Metrik GLM 5 GLM 5 medium Rilis: 2026-02-12 GLM 5.1 GLM 5.1 medium Rilis: 2026-04-07 Kimi K2.5 Kimi K2.5 medium Rilis: 2026-01-27 Qwen3.6 Plus Preview Qwen3.6 Plus Preview medium Rilis: 2026-04-20 Tersedia gratis
Skor 7.7 7.0 7.0 4.9
Peringkat #92 #142 #147 #280
Keandalan 10.0 8.1 10.0 T/A
Konsistensi 8.1 8.4 7.0 8.6
Percobaan 63/66 66/66 66/66 57/66
Tes benar
Tingkat lulus per percobaan 78.8% 65.2% 63.6% 40.9%
Tes tidak stabil 4 4 8 0
Total Run 63 66 66 57
Biaya per hasil 1.668 6.923 4.849 0.000
Total Biaya $0.228 $0.727 $0.479 $0.000
Harga input $0.600 / 1M $0.966 / 1M $0.450 / 1M $0.000 / 1M
Harga output $1.920 / 1M $3.036 / 1M $2.250 / 1M $0.000 / 1M
Total token input 35,224 82,592 118,496 32,639
Token output 21,570 16,089 53,522 1,153
Token penalaran 102,996 199,800 167,420 62,197
Waktu respons (rata-rata) 33.54s 58.80s 98.19s 15.25s
Waktu respons (maks) 99.85s 308.75s 281.00s 43.55s
Waktu respons (total) 435.99s 1234.72s 1571.05s 182.96s
Parameter 744B total (40B aktif) 744B total (40B aktif) 1T total (32B aktif) ~397B total (~17B aktif)
Ketersediaan Sumber terbuka Sumber terbuka Bobot tersedia Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#92 GLM 5

medium
Biaya
$0.005
Waktu
20.7s
Token
2,068 tok

#142 GLM 5.1

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
Biaya
$0.000
Waktu
300.0s
Token
0 tok

#147 MoonshotAI: Kimi K2.5

medium
Biaya
$0.030
Waktu
58.6s
Token
8,683 tok

#280 Qwen3.6 Plus Preview

medium
Belum ada hasil showcase yang dihasilkan untuk model ini.
Biaya
T/A
Waktu
-
Token
0 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
GLM 5 10.0 10.0 100.0% 0 74.30s 7,254 2,997 52,930
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826
Kimi K2.5 6.1 4.6 66.7% 2 217.49s 6,935 5,705 74,693
Qwen3.6 Plus Preview 9.8 3.3 0.0% 0 0ms 0 0 0

Perbandingan Cepat

Ganti Pasangan Perbandingan