Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Gemini 3.1 Flash Lite (medium) vs GPT-5.6 Luna (low)

Skor rata-rata hampir imbang di 6.9 vs 6.9. GPT-5.6 Luna (low) memiliki biaya benchmark lebih rendah di $0.075 vs $0.153. Gemini 3.1 Flash Lite (medium) lebih cepat di 6.27s vs 6.96s, dengan tingkat keberhasilan 59.4% vs 56.5%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-10-01

Model yang Dibandingkan

Peringkat
#162
Total token output
63,967
Waktu respons (rata-rata)
6.27s
Total Biaya
$0.153
Peringkat
#165
Total token output
28,001
Waktu respons (rata-rata)
6.96s
Total Biaya
$0.075
Model yang direkomendasikan GPT-5.6 Luna (low)

It has the best score here (6.9), while costing about 2.1x less than Gemini 3.1 Flash Lite (medium).

Perbandingan terperinci

Metrik Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium Rilis: 2026-05-08 GPT-5.6 Luna GPT-5.6 Luna low Rilis: 2026-07-09
Skor 6.9 6.9
Peringkat #162 #165
Keandalan 10.0 10.0
Konsistensi 9.2 8.3
Percobaan 69/69 69/69
Tes benar
Tingkat lulus per percobaan 59.4% 56.5%
Tes tidak stabil 2 5
Total Run 69 69
Biaya per hasil 1.177 2.428
Total Biaya $0.153 $0.075
Harga input $0.250 / 1M $0.200 / 1M
Harga output $1.500 / 1M $1.200 / 1M
Total token input 228,023 202,680
Token output 10,779 9,230
Token penalaran 53,188 18,771
Waktu respons (rata-rata) 6.27s 6.96s
Waktu respons (maks) 47.78s 45.74s
Waktu respons (total) 144.10s 160.19s
Parameter ~150B total (~10B aktif) ~400B total (~17B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#162 Gemini 3.1 Flash Lite

medium
Biaya
$0.003
Waktu
5.3s
Token
1,754 tok

#165 GPT-5.6 Luna

low
Biaya
$0.011
Waktu
10.2s
Token
1,897 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 3.81s 8,134 459 8,978
GPT-5.6 Luna 5.5 10.0 33.3% 0 4.61s 7,302 557 3,535

Perbandingan Cepat

Ganti Pasangan Perbandingan