Navigasi
Advertise here

Ember-1 vs Kimi K2.5

Ember-1 unggul dalam skor rata-rata dengan 5.4 vs 5.3. Kimi K2.5 memiliki biaya benchmark lebih rendah di $0.262 vs $0.786. Ember-1 lebih cepat di 22.65s vs 35.86s, dengan tingkat keberhasilan 43.5% vs 29.0%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#295
Total token output
11,832
Waktu respons (rata-rata)
22.65s
Total Biaya
$0.786
Peringkat
#299
Total token output
49,389
Waktu respons (rata-rata)
35.86s
Total Biaya
$0.262
Model yang direkomendasikan Kimi K2.5

Its score stays close to the best score here (5.3 vs 5.4), while costing about 3.0x less than Ember-1.

Perbandingan terperinci

Metrik Ember-1 Ember-1 none Rilis: 2026-09-28 Kimi K2.5 Kimi K2.5 none Rilis: 2026-01-27
Skor 5.4 5.3
Peringkat #295 #299
Keandalan 8.8 10.0
Konsistensi 8.6 8.6
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 43.5% 29.0%
Tes tidak stabil 4 4
Total Run 69 69
Biaya per hasil 9.817 4.976
Total Biaya $0.786 $0.262
Harga input $3.000 / 1M $0.450 / 1M
Harga output $15.000 / 1M $2.250 / 1M
Harga baca cache $0.300 / 1M $0.070 / 1M
Harga tulis cache T/A T/A
Total token input 202,617 275,349
Token output 11,832 49,377
Token penalaran 0 12
Waktu respons (rata-rata) 22.65s 35.86s
Waktu respons (maks) 93.12s 321.19s
Waktu respons (total) 520.91s 609.61s
Parameter ~2.8T total (~104B aktif) 1T total (32B aktif)
Ketersediaan Tertutup Bobot tersedia

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#295 Ember-1

none
Biaya
$0.156
Waktu
224.6s
Token
10,555 tok

#299 MoonshotAI: Kimi K2.5

none
Biaya
$0.015
Waktu
89.1s
Token
5,421 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Ember-1 5.5 10.0 33.3% 0 1.94s 7,485 393 0
Kimi K2.5 5.5 10.0 33.3% 0 24.56s 7,311 4,708 0

Ganti Pasangan Perbandingan