AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs Qwen: Qwen3.5 Plus 2026-02-15

Benchmark dihasilkan dari suite pengujian AI BENCHY pada: 2026-05-29

Metrik	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite high Rilis: 2026-05-08	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Rilis: 2026-02-15

Metrik	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite high Rilis: 2026-05-08	Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 medium Rilis: 2026-02-15
Skor	7.6	8.1
Peringkat	#49	#23
Keandalan	10.0	10.0
Konsistensi	8.1	8.8
Tes benar
Tingkat lulus per percobaan	74.1%	76.7%
Tes tidak stabil	4	3
Total Run	54	60
Biaya per hasil	18.579	2.251
Total Biaya	$2.044	$0.316
Harga input	$0.250 / 1M	$0.260 / 1M
Harga output	$1.500 / 1M	$1.560 / 1M
Token output	1,984	2,145
Token penalaran	1,355,583	172,563
Waktu respons (rata-rata)	61.96s	67.58s
Waktu respons (maks)	149.23s	266.69s
Waktu respons (total)	1115.31s	878.57s

Model teratas berdasarkan skor

Skor vs Total Biaya

Waktu respons (rata-rata)

Skor vs Waktu respons (rata-rata)

Total token output

Skor vs Total token output

Rincian Kategori

Trik anti-AI	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		37.16s	100	130,598
Qwen3.5 Plus 2026-02-15	8.2	7.9	83.3%	1		45.78s	205	21,236

Pemrograman	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		137.63s	666	188,733
Qwen3.5 Plus 2026-02-15	7.6	6.7	66.7%	1		193.80s	406	63,554

Gabungan	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		149.23s	327	198,243
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		46.85s	421	7,906

Parsing dan ekstraksi data	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		4.49s	279	7,351
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		46.91s	270	14,916

Spesifik domain	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Gemini 3.1 Flash Lite	3.6	7.2	22.2%	1		139.90s	18	566,210
Qwen3.5 Plus 2026-02-15	5.3	10.0	33.3%	0		17.50s	35	16,680

Kecerdasan umum	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Gemini 3.1 Flash Lite	5.0	2.1	66.7%	1		45.69s	95	64,644
Qwen3.5 Plus 2026-02-15	4.7	1.6	66.7%	1		79.86s	73	8,675

Kepatuhan instruksi	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Gemini 3.1 Flash Lite	7.3	5.8	83.3%	1		23.26s	52	3,549
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		31.93s	101	7,704

Pemecahan teka-teki	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Gemini 3.1 Flash Lite	5.7	6.8	44.4%	1		50.83s	213	193,654
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		32.50s	301	13,853

Pemanggilan alat	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		6.44s	234	2,601
Qwen3.5 Plus 2026-02-15	10.0	10.0	100.0%	0		7.54s	309	909

Pengetahuan umum	Skor	Konsistensi	Tingkat lulus per percobaan	Tes tidak stabil	Tes benar	Waktu respons (rata-rata)	Token output	Token penalaran
Gemini 3.1 Flash Lite	-	-	-	-	-	-	-	-
Qwen3.5 Plus 2026-02-15	3.0	10.0	0.0%	0		103.81s	24	17,130

Perbandingan Cepat

Ganti Pasangan Perbandingan

Gemini 3.5 FlashminimalvsQwen3.5 Plus 2026-02-15medium GPT-5.2 ChatnonevsQwen3.5 Plus 2026-02-15medium Gemini 3 Flash PreviewnonevsQwen3.5 Plus 2026-02-15medium DeepSeek V4 FlashhighTersedia gratisvsQwen3.5 Plus 2026-02-15medium Gemini 3.1 Flash Lite PreviewlowvsQwen3.5 Plus 2026-02-15medium Gemini 3 Flash PreviewlowvsQwen3.5 Plus 2026-02-15medium Gemini 3.1 Flash Lite PreviewnonevsQwen3.5 Plus 2026-02-15medium Gemini 3.1 Flash LitelowvsQwen3.5 Plus 2026-02-15medium GPT-5.3 ChatnonevsQwen3.5 Plus 2026-02-15medium Qwen3.5 Plus 2026-02-15mediumvsStep 3.7 Flashlow Claude Opus 4.8nonevsQwen3.5 Plus 2026-02-15medium Ring-2.6-1TnonevsQwen3.5 Plus 2026-02-15medium