Navigasi
AI BENCHY
Advertise here

AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs Google: Gemini 3.1 Flash Lite Preview

Ringkasan

Perbandingan benchmark Gemini 3.1 Flash Lite vs Gemini 3.1 Flash Lite Preview: Gemini 3.1 Flash Lite Preview unggul dalam skor rata-rata dengan 6.5 vs 6.1. Gemini 3.1 Flash Lite memiliki biaya benchmark lebih rendah di $0.013 vs $0.026. Gemini 3.1 Flash Lite lebih cepat di 1.33s vs 2.77s, dengan tingkat keberhasilan 54.0% vs 61.9%.

Model yang direkomendasikan: Gemini 3.1 Flash Lite - Its score stays close to the best score here (6.1 vs 6.5), while costing about 2.0x less than Gemini 3.1 Flash Lite Preview.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-06-18

Metrik Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal Rilis: 2026-05-08 Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low Rilis: 2026-03-03
Skor 6.1 6.5
Peringkat #94 #82
Keandalan 10.0 10.0
Konsistensi 8.8 10.0
Tes benar
Tingkat lulus per percobaan 54.0% 61.9%
Tes tidak stabil 3 0
Total Run 63 63
Biaya per hasil 0.130 0.196
Total Biaya $0.013 $0.026
Harga input $0.250 / 1M $0.250 / 1M
Harga output $1.500 / 1M $1.500 / 1M
Total token input 36,973 32,715
Token output 2,487 2,286
Token penalaran 0 9,166
Waktu respons (rata-rata) 1.33s 2.77s
Waktu respons (maks) 4.49s 11.91s
Waktu respons (total) 27.91s 58.12s

Showcase generasi

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#94 Gemini 3.1 Flash Lite

minimal
Biaya
$0.001
Waktu
3.7s
Token
635 tok

#82 Gemini 3.1 Flash Lite Preview

low
Biaya
$0.002
Waktu
3.7s
Token
1,203 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Trik anti-AI Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 8.3 10.0 75.0% 0 1.10s 500 639 0
Gemini 3.1 Flash Lite Preview 8.3 10.0 75.0% 0 2.12s 506 462 1,638
Pemrograman Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 5.5 10.0 33.3% 0 831ms 8,126 666 0
Gemini 3.1 Flash Lite Preview 5.5 10.0 33.3% 0 1.39s 8,138 660 1,060
Gabungan Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 2.53s 12,870 357 0
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 11.91s 8,381 225 762
Parsing dan ekstraksi data Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 1.04s 7,552 279 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 3.00s 7,455 291 696
Spesifik domain Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 2.9 7.2 11.1% 1 1.02s 641 15 0
Gemini 3.1 Flash Lite Preview 5.3 10.0 33.3% 0 2.36s 641 18 1,212
Kecerdasan umum Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 4.0 10.0 0.0% 0 791ms 490 63 0
Gemini 3.1 Flash Lite Preview 4.0 10.0 0.0% 0 1.54s 490 69 384
Kepatuhan instruksi Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 932ms 615 72 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.49s 621 72 753
Pemecahan teka-teki Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 6.0 4.6 66.7% 2 2.15s 564 153 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 1.69s 566 243 1,248
Pemanggilan alat Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 10.0 10.0 100.0% 0 3.51s 5,457 234 0
Gemini 3.1 Flash Lite Preview 10.0 10.0 100.0% 0 9.54s 5,757 237 993
Pengetahuan umum Skor Konsistensi Tingkat lulus per percobaan Tes tidak stabil Tes benar Waktu respons (rata-rata) Token input Token output Token penalaran
Gemini 3.1 Flash Lite 3.0 10.0 0.0% 0 724ms 158 9 0
Gemini 3.1 Flash Lite Preview 3.0 10.0 0.0% 0 1.35s 160 9 420

Perbandingan Cepat

Ganti Pasangan Perbandingan