Navigasi
Advertise here

Ember-1 (high) vs Gemini 3.1 Flash Lite Preview (medium)

Gemini 3.1 Flash Lite Preview (medium) unggul dalam skor rata-rata dengan 7.0 vs 6.9. Gemini 3.1 Flash Lite Preview (medium) memiliki biaya benchmark lebih rendah di $0.158 vs $2.405. Gemini 3.1 Flash Lite Preview (medium) lebih cepat di 6.78s vs 58.14s, dengan tingkat keberhasilan 71.0% vs 60.9%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-09

Model yang Dibandingkan

Peringkat
#175
Total token output
121,223
Waktu respons (rata-rata)
58.14s
Total Biaya
$2.405
Peringkat
#166
Total token output
59,534
Waktu respons (rata-rata)
6.78s
Total Biaya
$0.158
Model yang direkomendasikan Gemini 3.1 Flash Lite Preview (medium)

It has the best score here (7.0), while costing about 15.3x less than Ember-1 (high).

Perbandingan terperinci

Metrik Ember-1 Ember-1 high Rilis: 2026-09-28 Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview medium Rilis: 2026-03-03
Skor 6.9 7.0
Peringkat #175 #166
Keandalan 8.6 10.0
Konsistensi 7.2 9.9
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 71.0% 60.9%
Tes tidak stabil 8 0
Total Run 69 69
Biaya per hasil 20.041 1.124
Total Biaya $2.405 $0.158
Harga input $3.000 / 1M $0.250 / 1M
Harga output $15.000 / 1M $1.500 / 1M
Harga baca cache $0.300 / 1M $0.025 / 1M
Harga tulis cache T/A $0.084 / 1M
Total token input 195,489 272,221
Token output 12,475 12,345
Token penalaran 108,748 47,189
Waktu respons (rata-rata) 58.14s 6.78s
Waktu respons (maks) 255.06s 54.91s
Waktu respons (total) 1337.19s 155.96s
Parameter ~2.8T total (~104B aktif) ~150B total (~10B aktif)
Ketersediaan Tertutup Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#175 Ember-1

high
Biaya
$0.038
Waktu
55.1s
Token
2,671 tok

#166 Gemini 3.1 Flash Lite Preview

medium
Biaya
$0.003
Waktu
5.2s
Token
1,944 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Ember-1 8.2 7.2 88.9% 1 72.23s 7,144 1,281 23,093
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 4.09s 8,126 461 8,597

Ganti Pasangan Perbandingan