Navigasi
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Gemini 3.5 Flash Lite (high) vs GPT-5.6 Sol (medium)

GPT-5.6 Sol (medium) unggul dalam skor rata-rata dengan 9.4 vs 8.8. Gemini 3.5 Flash Lite (high) memiliki biaya benchmark lebih rendah di $0.540 vs $0.723. Gemini 3.5 Flash Lite (high) lebih cepat di 10.05s vs 12.63s, dengan tingkat keberhasilan 83.3% vs 90.9%.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-08-20

Peringkat
#25
Total token output
204,625
Waktu respons (rata-rata)
10.05s
Total Biaya
$0.540
Peringkat
#8
Total token output
34,977
Waktu respons (rata-rata)
12.63s
Total Biaya
$0.723
Model yang direkomendasikan GPT-5.6 Sol (medium)

It has the strongest score in this comparison (9.4) and the best overall balance of cost and response time across all 2 models.

Perbandingan terperinci

Metrik Gemini 3.5 Flash Lite Gemini 3.5 Flash Lite high Rilis: 2026-07-21 GPT-5.6 Sol GPT-5.6 Sol medium Rilis: 2026-07-09
Skor 8.8 9.4
Peringkat #25 #8
Keandalan 10.0 10.0
Konsistensi 9.3 8.9
Percobaan 66/66 66/66
Tes benar
Tingkat lulus per percobaan 83.3% 90.9%
Tes tidak stabil 2 3
Total Run 66 66
Biaya per hasil 3.174 8.025
Total Biaya $0.540 $0.723
Harga input $0.300 / 1M $2.500 / 1M
Harga output $2.500 / 1M $15.000 / 1M
Total token input 93,046 79,006
Token output 5,884 4,696
Token penalaran 198,741 30,281
Waktu respons (rata-rata) 10.05s 12.63s
Waktu respons (maks) 36.22s 79.40s
Waktu respons (total) 221.06s 277.88s
Parameter ~150B total (~10B aktif) ~2T total (~150B aktif)
Ketersediaan Tertutup Tertutup

Showcase generasi model

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Gemini 3.5 Flash Lite

high
Biaya
$0.025
Waktu
36.8s
Token
9,964 tok

#8 GPT-5.6 Sol

medium
Biaya
$0.124
Waktu
57.2s
Token
4,199 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.5 Flash Lite 8.4 7.4 88.9% 1 16.58s 8,130 434 57,369
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

Perbandingan Cepat

Ganti Pasangan Perbandingan