AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs Qwen: Qwen3.5-27B

Rezumat

Comparație benchmark Gemini 3.1 Flash Lite vs Qwen3.5-27B: Gemini 3.1 Flash Lite conduce la scorul mediu cu 6.1 vs 5.9. Gemini 3.1 Flash Lite are costul de benchmark mai mic, $0.013 vs $0.015. Gemini 3.1 Flash Lite este mai rapid cu 1.33s vs 1.68s, cu rate de reușită de 54.0% vs 38.1%.

Model recomandat: Gemini 3.1 Flash Lite - Are cel mai puternic scor din această comparație (6.1) și cel mai bun echilibru între cost și timp de răspuns dintre toate cele 2 modele.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-12

Metrică	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal Lansare: 2026-05-08	Qwen3.5-27B Qwen3.5-27B none Lansare: 2026-02-24

Metrică	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal Lansare: 2026-05-08	Qwen3.5-27B Qwen3.5-27B none Lansare: 2026-02-24
Scor	6.1	5.9
Rang	#95	#109
Fiabilitate	10.0	10.0
Consistență	8.8	9.3
Teste corecte
Rată de trecere pe încercare	54.0%	38.1%
Teste instabile	3	2
Rulări totale	63	63
Cost per rezultat	0.130	0.249
Cost total	$0.013	$0.015
Preț de intrare	$0.250 / 1M	$0.195 / 1M
Preț de ieșire	$1.500 / 1M	$1.560 / 1M
Total tokenuri de intrare	36,973	44,478
Tokenuri de ieșire	2,487	3,592
Tokenuri de raționament	0	0
Timp de răspuns (mediu)	1.33s	1.68s
Timp de răspuns (maxim)	4.49s	9.39s
Timp de răspuns (total)	27.91s	35.25s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#95 Gemini 3.1 Flash Lite

minimal

Cost: $0.001
Time: 3.7s
Tokens: 635 tok

#109 Qwen3.5-27B

none

Cost: $0.007
Time: 42.9s
Tokens: 4,273 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	8.3	10.0	75.0%	0		1.10s	500	639	0
Qwen3.5-27B	4.8	10.0	25.0%	0		788ms	696	267	0

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	5.5	10.0	33.3%	0		831ms	8,126	666	0
Qwen3.5-27B	5.8	10.0	33.3%	0		1.80s	7,913	415	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		2.53s	12,870	357	0
Qwen3.5-27B	2.8	1.6	33.3%	1		9.39s	16,918	1,461	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.04s	7,552	279	0
Qwen3.5-27B	10.0	10.0	100.0%	0		1.43s	7,794	243	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	2.9	7.2	11.1%	1		1.02s	641	15	0
Qwen3.5-27B	3.0	10.0	0.0%	0		540ms	789	15	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	4.0	10.0	0.0%	0		791ms	490	63	0
Qwen3.5-27B	5.0	10.0	0.0%	0		2.51s	522	126	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		932ms	615	72	0
Qwen3.5-27B	6.3	10.0	50.0%	0		1.03s	711	69	0

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	6.0	4.6	66.7%	2		2.15s	564	153	0
Qwen3.5-27B	6.7	7.9	55.6%	1		1.38s	714	683	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		3.51s	5,457	234	0
Qwen3.5-27B	10.0	10.0	100.0%	0		3.54s	8,211	303	0

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		724ms	158	9	0
Qwen3.5-27B	3.0	10.0	0.0%	0		599ms	210	10	0

Comparație rapidă

Schimbă perechea de comparație