Navigasi
Advertise here

Gemini 3.1 Flash Lite Preview (medium) vs GPT-5.6 Luna (low)

Gemini 3.1 Flash Lite Preview (medium) unggul dalam skor rata-rata dengan 7.0 vs 6.9. GPT-5.6 Luna (low) memiliki biaya benchmark lebih rendah di $0.049 vs $0.158. Gemini 3.1 Flash Lite Preview (medium) lebih cepat di 6.78s vs 6.96s, dengan tingkat keberhasilan 60.9% vs 56.5%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-09

Model yang Dibandingkan

Peringkat
#166
Total token output
59,534
Waktu respons (rata-rata)
6.78s
Total Biaya
$0.158
Peringkat
#177
Total token output
28,001
Waktu respons (rata-rata)
6.96s
Total Biaya
$0.049
Model yang direkomendasikan GPT-5.6 Luna (low)

Its score stays close to the best score here (6.9 vs 7.0), while costing about 3.2x less than Gemini 3.1 Flash Lite Preview (medium).

Perbandingan terperinci

Metrik Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview medium Rilis: 2026-03-03 GPT-5.6 Luna GPT-5.6 Luna low Rilis: 2026-07-09
Skor 7.0 6.9
Peringkat #166 #177
Keandalan 10.0 10.0
Konsistensi 9.9 8.3
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 60.9% 56.5%
Tes tidak stabil 0 5
Total Run 69 69
Biaya per hasil 1.124 2.428
Total Biaya $0.158 $0.049
Harga input $0.250 / 1M $0.200 / 1M
Harga output $1.500 / 1M $1.200 / 1M
Harga baca cache $0.025 / 1M $0.020 / 1M
Harga tulis cache $0.084 / 1M $0.250 / 1M
Total token input 272,221 202,680
Token output 12,345 9,230
Token penalaran 47,189 18,771
Waktu respons (rata-rata) 6.78s 6.96s
Waktu respons (maks) 54.91s 45.74s
Waktu respons (total) 155.96s 160.19s
Parameter ~150B total (~10B aktif) ~400B total (~17B aktif)
Ketersediaan Tertutup Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#166 Gemini 3.1 Flash Lite Preview

medium
Biaya
$0.003
Waktu
5.2s
Token
1,944 tok

#177 GPT-5.6 Luna

low
Biaya
$0.011
Waktu
10.2s
Token
1,897 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 4.09s 8,126 461 8,597
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

Ganti Pasangan Perbandingan