AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs Google: Gemini 3 Flash Preview

Ringkasan

Perbandingan benchmark Gemini 3.1 Flash Lite vs Gemini 3 Flash Preview: Gemini 3 Flash Preview unggul dalam skor rata-rata dengan 9.6 vs 6.5. Gemini 3 Flash Preview memiliki biaya benchmark lebih rendah di $0.667 vs $2.044. Gemini 3 Flash Preview lebih cepat di 18.64s vs 61.96s, dengan tingkat keberhasilan 58.7% vs 98.4%.

Model yang direkomendasikan: Gemini 3 Flash Preview - It has the best score here (9.6), while costing about 3.1x less than Gemini 3.1 Flash Lite.

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-06-18

Metrik	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite high Rilis: 2026-05-08	Gemini 3 Flash Preview Gemini 3 Flash Preview medium Rilis: 2025-12-17

Metrik	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite high Rilis: 2026-05-08	Gemini 3 Flash Preview Gemini 3 Flash Preview medium Rilis: 2025-12-17
Skor	6.5	9.6
Peringkat	#83	#2
Keandalan	10.0	10.0
Konsistensi	6.8	9.7
Tes benar
Tingkat lulus per percobaan	58.7%	98.4%
Tes tidak stabil	4	1
Total Run	54	63
Biaya per hasil	20.437	3.335
Total Biaya	$2.044	$0.667
Harga input	$0.250 / 1M	$0.500 / 1M
Harga output	$1.500 / 1M	$3.000 / 1M
Total token input	29,134	37,017
Token output	1,984	2,006
Token penalaran	1,355,583	214,153
Waktu respons (rata-rata)	61.96s	18.64s
Waktu respons (maks)	149.23s	117.26s
Waktu respons (total)	1115.31s	391.35s

Showcase generasi

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#83 Gemini 3.1 Flash Lite

high

SVG tidak valid

Biaya: $0.000
Waktu: 15.5s
Token: 0 tok

#2 Gemini 3 Flash Preview

medium

Biaya: $0.010
Waktu: 17.9s
Token: 3,236 tok

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Trik anti-AI	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Gemini 3.1 Flash Lite	8.7	9.5	75.0%	0		37.16s	459	100	130,598
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		3.88s	494	330	3,216

Pemrograman	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Gemini 3.1 Flash Lite	3.3	3.3	33.3%	0		137.63s	762	666	188,733
Gemini 3 Flash Preview	8.6	7.6	88.9%	1		84.40s	8,122	462	161,084

Gabungan	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		149.23s	12,873	327	198,243
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		22.42s	12,873	351	10,485

Parsing dan ekstraksi data	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		4.49s	7,360	279	7,351
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.43s	7,548	279	4,893

Spesifik domain	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Gemini 3.1 Flash Lite	3.6	7.2	22.2%	1		139.90s	645	18	566,210
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		15.27s	633	12	21,684

Kecerdasan umum	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Gemini 3.1 Flash Lite	5.0	2.1	66.7%	1		45.69s	488	95	64,644
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.19s	486	72	1,905

Kepatuhan instruksi	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Gemini 3.1 Flash Lite	7.3	5.8	83.3%	1		23.26s	528	52	3,549
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		4.04s	615	72	2,709

Pemecahan teka-teki	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Gemini 3.1 Flash Lite	5.7	6.8	44.4%	1		50.83s	562	213	193,654
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		4.05s	558	183	4,365

Pemanggilan alat	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		6.44s	5,457	234	2,601
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		12.60s	5,532	234	1,487

Pengetahuan umum	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token input	Token output	Token penalaran
Gemini 3.1 Flash Lite	0.0	0.0	0.0%	0		0ms	0	0	0
Gemini 3 Flash Preview	10.0	10.0	100.0%	0		5.50s	156	11	2,325

Perbandingan Cepat

Ganti Pasangan Perbandingan