AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs Qwen: Qwen3.5-122B-A10B

Rezumat

Comparație benchmark Gemini 3.1 Flash Lite vs Qwen3.5-122B-A10B: Gemini 3.1 Flash Lite conduce la scorul mediu cu 6.1 vs 5.3. Gemini 3.1 Flash Lite are costul de benchmark mai mic, $0.013 vs $0.020. Gemini 3.1 Flash Lite este mai rapid cu 1.33s vs 3.41s, cu rate de reușită de 54.0% vs 31.8%.

Model recomandat: Gemini 3.1 Flash Lite - Are cel mai bun scor aici (6.1) și răspunde de aproximativ 2.6x mai rapid decât Qwen3.5-122B-A10B.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-12

Metrică	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal Lansare: 2026-05-08	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Lansare: 2026-02-24

Metrică	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite minimal Lansare: 2026-05-08	Qwen3.5-122B-A10B Qwen3.5-122B-A10B none Lansare: 2026-02-24
Scor	6.1	5.3
Rang	#95	#132
Fiabilitate	10.0	10.0
Consistență	8.8	9.6
Teste corecte
Rată de trecere pe încercare	54.0%	31.8%
Teste instabile	3	1
Rulări totale	63	63
Cost per rezultat	0.130	0.393
Cost total	$0.013	$0.020
Preț de intrare	$0.250 / 1M	$0.260 / 1M
Preț de ieșire	$1.500 / 1M	$2.080 / 1M
Total tokenuri de intrare	36,973	47,735
Tokenuri de ieșire	2,487	3,383
Tokenuri de raționament	0	0
Timp de răspuns (mediu)	1.33s	3.41s
Timp de răspuns (maxim)	4.49s	46.00s
Timp de răspuns (total)	27.91s	71.59s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#95 Gemini 3.1 Flash Lite

minimal

Cost: $0.001
Time: 3.7s
Tokens: 635 tok

#132 Qwen3.5-122B-A10B

none

Cost: $0.016
Time: 44.5s
Tokens: 6,431 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	8.3	10.0	75.0%	0		1.10s	500	639	0
Qwen3.5-122B-A10B	4.8	10.0	25.0%	0		1.59s	696	312	0

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	5.5	10.0	33.3%	0		831ms	8,126	666	0
Qwen3.5-122B-A10B	3.7	7.0	22.2%	1		2.77s	7,913	693	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		2.53s	12,870	357	0
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		46.00s	20,175	1,137	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		1.04s	7,552	279	0
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		1.01s	7,794	243	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	2.9	7.2	11.1%	1		1.02s	641	15	0
Qwen3.5-122B-A10B	5.3	10.0	33.3%	0		465ms	789	15	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	4.0	10.0	0.0%	0		791ms	490	63	0
Qwen3.5-122B-A10B	5.0	10.0	0.0%	0		1.12s	522	66	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		932ms	615	72	0
Qwen3.5-122B-A10B	6.3	10.0	50.0%	0		513ms	711	69	0

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	6.0	4.6	66.7%	2		2.15s	564	153	0
Qwen3.5-122B-A10B	3.8	10.0	0.0%	0		1.00s	714	575	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		3.51s	5,457	234	0
Qwen3.5-122B-A10B	10.0	10.0	100.0%	0		2.04s	8,211	264	0

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		724ms	158	9	0
Qwen3.5-122B-A10B	3.0	10.0	0.0%	0		295ms	210	9	0

Comparație rapidă

Schimbă perechea de comparație

Gemini 3.1 Flash LiteminimalvsQwen3.5-Flashnone Seed-2.0-LitenonevsGemini 3.1 Flash Liteminimal Gemini 3.1 Flash LiteminimalvsNemotron 3 Ultra 550b A55bnoneDisponibil gratuit MiniMax M2.7mediumvsQwen3.5-122B-A10Bnone DeepSeek V4 PrononevsGemini 3.1 Flash Liteminimal DeepSeek V4 ProhighvsGemini 3.1 Flash Liteminimal Gemini 3.1 Flash LiteminimalvsGPT-5.5none Gemini 3.1 Flash LiteminimalvsQwen3.6 Max Previewnone Gemini 3.1 Flash LiteminimalvsQwen3.5-35B-A3Bmedium Gemini 3.1 Flash LiteminimalvsGLM 5none Mistral Small 4mediumvsQwen3.5-122B-A10Bnone Gemini 3.1 Flash LiteminimalvsQwen3.6 Flashnone