Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Gemini 3.5 Flash (medium) vs GPT-6 Luna (high)

Gemini 3.5 Flash (medium) unggul dalam skor rata-rata dengan 7.9 vs 7.7. GPT-6 Luna (high) memiliki biaya benchmark lebih rendah di $0.074 vs $1.316. Gemini 3.5 Flash (medium) lebih cepat di 11.78s vs 20.37s, dengan tingkat keberhasilan 81.2% vs 73.9%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-02

Model yang Dibandingkan

Peringkat
#101
Total token output
96,655
Waktu respons (rata-rata)
11.78s
Total Biaya
$1.316
Peringkat
#111
Total token output
101,587
Waktu respons (rata-rata)
20.37s
Total Biaya
$0.074
Model yang direkomendasikan GPT-6 Luna (high)

Its score stays close to the best score here (7.7 vs 7.9), while costing about 17.8x less than Gemini 3.5 Flash (medium).

Perbandingan terperinci

Metrik Gemini 3.5 Flash Gemini 3.5 Flash medium Rilis: 2026-05-19 GPT-6 Luna GPT-6 Luna high Rilis: 2026-09-23
Skor 7.9 7.7
Peringkat #101 #111
Keandalan 10.0 10.0
Konsistensi 9.3 8.7
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 81.2% 73.9%
Tes tidak stabil 2 4
Total Run 69 69
Biaya per hasil 7.306 0.492
Total Biaya $1.316 $0.074
Harga input $1.500 / 1M $0.100 / 1M
Harga output $9.000 / 1M $0.500 / 1M
Harga baca cache $0.150 / 1M $0.010 / 1M
Harga tulis cache $0.084 / 1M $0.125 / 1M
Total token input 296,760 229,986
Token output 4,371 6,037
Token penalaran 92,284 95,550
Waktu respons (rata-rata) 11.78s 20.37s
Waktu respons (maks) 84.47s 106.93s
Waktu respons (total) 271.03s 468.52s
Parameter ~500B total (~20B aktif) ~400B total (~17B aktif)
Ketersediaan Tertutup Tertutup

Harga cache berlaku untuk token input. Pembacaan memakai kembali prompt tersimpan; penulisan menyimpannya dan dapat menambah biaya. Token output menggunakan harga output.

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#101 Gemini 3.5 Flash

medium
Biaya
$0.201
Waktu
112.9s
Token
22,371 tok

#111 GPT-6 Luna

high
Biaya
$0.003
Waktu
49.2s
Token
5,231 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.5 Flash 7.9 7.5 77.8% 1 12.63s 8,118 461 24,939
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

Perbandingan Cepat

Ganti Pasangan Perbandingan