Navigasi
Advertise here

Gemini 3 Flash Preview (low) vs GPT-5.6 Luna (low)

Gemini 3 Flash Preview (low) unggul dalam skor rata-rata dengan 6.9 vs 6.9. GPT-5.6 Luna (low) memiliki biaya benchmark lebih rendah di $0.049 vs $0.254. GPT-5.6 Luna (low) lebih cepat di 6.96s vs 8.51s, dengan tingkat keberhasilan 72.5% vs 56.5%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-07

Model yang Dibandingkan

Peringkat
#171
Total token output
42,400
Waktu respons (rata-rata)
8.51s
Total Biaya
$0.254
Peringkat
#176
Total token output
28,001
Waktu respons (rata-rata)
6.96s
Total Biaya
$0.049
Model yang direkomendasikan GPT-5.6 Luna (low)

Its score stays close to the best score here (6.9 vs 6.9), while costing about 5.2x less than Gemini 3 Flash Preview (low).

Perbandingan terperinci

Metrik Gemini 3 Flash Preview Gemini 3 Flash Preview low Rilis: 2025-12-17 GPT-5.6 Luna GPT-5.6 Luna low Rilis: 2026-07-09
Skor 6.9 6.9
Peringkat #171 #176
Keandalan 10.0 10.0
Konsistensi 9.3 8.3
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 72.5% 56.5%
Tes tidak stabil 2 5
Total Run 69 69
Biaya per hasil 1.582 2.428
Total Biaya $0.254 $0.049
Harga input $0.500 / 1M $0.200 / 1M
Harga output $3.000 / 1M $1.200 / 1M
Harga baca cache $0.050 / 1M $0.020 / 1M
Harga tulis cache $0.084 / 1M $0.250 / 1M
Total token input 251,677 202,680
Token output 11,196 9,230
Token penalaran 31,204 18,771
Waktu respons (rata-rata) 8.51s 6.96s
Waktu respons (maks) 52.64s 45.74s
Waktu respons (total) 195.76s 160.19s
Parameter ~500B total (~20B aktif) ~400B total (~17B aktif)
Ketersediaan Tertutup Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#171 Gemini 3 Flash Preview

low
Biaya
$0.007
Waktu
12.1s
Token
2,289 tok

#176 GPT-5.6 Luna

low
Biaya
$0.011
Waktu
10.2s
Token
1,897 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3 Flash Preview 5.8 7.2 44.4% 1 6.00s 8,122 456 7,421
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

Ganti Pasangan Perbandingan