Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Ember-1 (max) vs GLM 5.3 Flash (low)

Skor rata-rata hampir imbang di 5.9 vs 5.9. GLM 5.3 Flash (low) memiliki biaya benchmark lebih rendah di $0.030 vs $2.792. GLM 5.3 Flash (low) lebih cepat di 9.65s vs 98.92s, dengan tingkat keberhasilan 57.6% vs 56.1%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-28

Model yang Dibandingkan

Peringkat
#248
Total token output
180,806
Waktu respons (rata-rata)
98.92s
Total Biaya
$2.792
Peringkat
#250
Total token output
23,736
Waktu respons (rata-rata)
9.65s
Total Biaya
$0.030
Model yang direkomendasikan GLM 5.3 Flash (low)

It has the best score here (5.9), while costing about 94.6x less than Ember-1 (max).

Perbandingan terperinci

Metrik Ember-1 Ember-1 max Rilis: 2026-09-28 GLM 5.3 Flash GLM 5.3 Flash low Rilis: 2026-08-26
Skor 5.9 5.9
Peringkat #248 #250
Keandalan 7.5 10.0
Konsistensi 7.7 8.4
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 57.6% 56.1%
Tes tidak stabil 6 4
Total Run 66 66
Biaya per hasil 27.915 0.148
Total Biaya $2.792 $0.030
Harga input $3.000 / 1M $0.150 / 1M
Harga output $15.000 / 1M $0.500 / 1M
Total token input 26,449 117,551
Token output 4,183 9,199
Token penalaran 176,623 14,537
Waktu respons (rata-rata) 98.92s 9.65s
Waktu respons (maks) 587.08s 90.45s
Waktu respons (total) 2176.20s 212.22s
Parameter ~2.8T total (~104B aktif) 320B total (18B aktif)
Ketersediaan Tertutup Sumber terbuka

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#248 Ember-1

max
Biaya
$0.163
Waktu
229.4s
Token
11,002 tok

#250 GLM 5.3 Flash

low
Biaya
$0.001
Waktu
20.7s
Token
1,482 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Ember-1 5.2 4.4 55.6% 2 105.09s 3,362 1,149 27,957
GLM 5.3 Flash 5.4 7.2 44.4% 1 10.38s 7,317 398 3,973

Perbandingan Cepat

Ganti Pasangan Perbandingan