Navigasi
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Gemini 3.5 Flash Lite (medium) vs GPT-6 Luna (medium)

Skor rata-rata hampir imbang di 7.8 vs 7.9. GPT-6 Luna (medium) memiliki biaya benchmark lebih rendah di $0.031 vs $0.272. Gemini 3.5 Flash Lite (medium) lebih cepat di 5.12s vs 15.87s, dengan tingkat keberhasilan 78.8% vs 72.7%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-09-23

Model yang Dibandingkan

Peringkat
#97
Total token output
96,235
Waktu respons (rata-rata)
5.12s
Total Biaya
$0.272
Peringkat
#94
Total token output
45,154
Waktu respons (rata-rata)
15.87s
Total Biaya
$0.031
Model yang direkomendasikan GPT-6 Luna (medium)

It has the best score here (7.9), while costing about 8.9x less than Gemini 3.5 Flash Lite (medium).

Perbandingan terperinci

Metrik Gemini 3.5 Flash Lite Gemini 3.5 Flash Lite medium Rilis: 2026-07-21 GPT-6 Luna GPT-6 Luna medium Rilis: 2026-09-23
Skor 7.8 7.9
Peringkat #97 #94
Keandalan 10.0 10.0
Konsistensi 7.8 8.9
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 78.8% 72.7%
Tes tidak stabil 6 3
Total Run 66 66
Biaya per hasil 1.942 0.218
Total Biaya $0.272 $0.031
Harga input $0.300 / 1M $0.100 / 1M
Harga output $2.500 / 1M $0.500 / 1M
Total token input 103,916 78,946
Token output 8,892 4,635
Token penalaran 87,343 40,519
Waktu respons (rata-rata) 5.12s 15.87s
Waktu respons (maks) 26.41s 35.14s
Waktu respons (total) 112.73s 349.09s
Parameter ~150B total (~10B aktif) ~400B total (~17B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 Gemini 3.5 Flash Lite

medium
Biaya
$0.010
Waktu
17.8s
Token
4,000 tok

#94 GPT-6 Luna

medium
Biaya
$0.002
Waktu
23.6s
Token
2,966 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.5 Flash Lite 7.9 9.9 66.7% 0 9.96s 8,122 471 28,930
GPT-6 Luna 6.6 4.6 77.8% 2 23.63s 7,302 438 10,222

Perbandingan Cepat

Ganti Pasangan Perbandingan