Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Gemini 3.5 Flash Lite (medium) vs GPT-5.6 Luna (high)

Gemini 3.5 Flash Lite (medium) unggul dalam skor rata-rata dengan 7.8 vs 7.7. GPT-5.6 Luna (high) memiliki biaya benchmark lebih rendah di $0.102 vs $0.273. Gemini 3.5 Flash Lite (medium) lebih cepat di 5.20s vs 18.68s, dengan tingkat keberhasilan 78.8% vs 72.7%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-11

Peringkat
#54
Total token output
96,653
Waktu respons (rata-rata)
5.20s
Total Biaya
$0.273
Peringkat
#62
Total token output
155,998
Waktu respons (rata-rata)
18.68s
Total Biaya
$0.102
Model yang direkomendasikan Gemini 3.5 Flash Lite (medium)

It has the best score here (7.8), while responding about 3.6x faster than GPT-5.6 Luna (high).

Perbandingan terperinci

Metrik Gemini 3.5 Flash Lite Gemini 3.5 Flash Lite medium Rilis: 2026-07-21 GPT-5.6 Luna GPT-5.6 Luna high Rilis: 2026-07-09
Skor 7.8 7.7
Peringkat #54 #62
Keandalan 10.0 10.0
Konsistensi 7.8 8.9
Cakupan benchmark 22/22 tes · 66/66 percobaan 22/22 tes · 66/66 percobaan
Tes benar
Tingkat lulus per percobaan 78.8% 72.7%
Tes tidak stabil 6 3
Total Run 66 66
Biaya per hasil 1.949 6.780
Total Biaya $0.273 $0.102
Harga input $0.300 / 1M $0.100 / 1M
Harga output $2.500 / 1M $0.600 / 1M
Total token input 103,903 80,918
Token output 8,892 5,088
Token penalaran 87,761 150,910
Waktu respons (rata-rata) 5.20s 18.68s
Waktu respons (maks) 26.41s 111.09s
Waktu respons (total) 114.46s 411.05s

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#54 Gemini 3.5 Flash Lite

medium
Biaya
$0.010
Waktu
17.8s
Token
4,000 tok

#62 GPT-5.6 Luna

high
Biaya
$0.033
Waktu
34.2s
Token
5,484 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.5 Flash Lite 7.9 9.9 66.7% 0 9.96s 8,122 471 28,930
GPT-5.6 Luna 5.5 4.7 55.6% 2 15.63s 7,302 510 17,746

Perbandingan Cepat

Ganti Pasangan Perbandingan