Navigasi
Advertise here

Ember-1 (high) vs Mercury 2.5 Preview (medium)

Ember-1 (high) unggul dalam skor rata-rata dengan 6.9 vs 6.8. Mercury 2.5 Preview (medium) memiliki biaya benchmark lebih rendah di $0.037 vs $2.405. Mercury 2.5 Preview (medium) lebih cepat di 6.66s vs 58.14s, dengan tingkat keberhasilan 71.0% vs 66.7%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-01

Model yang Dibandingkan

Peringkat
#163
Total token output
121,223
Waktu respons (rata-rata)
58.14s
Total Biaya
$2.405
Peringkat
#171
Total token output
150,107
Waktu respons (rata-rata)
6.66s
Total Biaya
$0.037
Model yang direkomendasikan Mercury 2.5 Preview (medium)

Its score stays close to the best score here (6.8 vs 6.9), while costing about 65.8x less than Ember-1 (high).

Perbandingan terperinci

Metrik Ember-1 Ember-1 high Rilis: 2026-09-28 Mercury 2.5 Preview Mercury 2.5 Preview medium Rilis: 2026-09-02
Skor 6.9 6.8
Peringkat #163 #171
Keandalan 8.6 10.0
Konsistensi 7.2 9.6
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 71.0% 66.7%
Tes tidak stabil 8 1
Total Run 69 69
Biaya per hasil 20.041 0.244
Total Biaya $2.405 $0.037
Harga input $3.000 / 1M $0.000 / 1M
Harga output $15.000 / 1M $0.000 / 1M
Total token input 195,489 397,291
Token output 12,475 6,355
Token penalaran 108,748 143,752
Waktu respons (rata-rata) 58.14s 6.66s
Waktu respons (maks) 255.06s 74.63s
Waktu respons (total) 1337.19s 153.29s
Parameter ~2.8T total (~104B aktif) ~100B
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#163 Ember-1

high
Biaya
$0.038
Waktu
55.1s
Token
2,671 tok

#171 Mercury 2.5 Preview

medium
Biaya
$0.001
Waktu
2.7s
Token
2,241 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Ember-1 8.2 7.2 88.9% 1 72.23s 7,144 1,281 23,093
Mercury 2.5 Preview 7.8 10.0 66.7% 0 3.86s 7,839 552 22,126

Perbandingan Cepat

Ganti Pasangan Perbandingan