AI BENCHY Compare

Google: Gemini 3.1 Flash Lite Preview vs Xiaomi: MiMo-V2-Pro

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-03-20

Metrică	Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low Lansare: 2026-03-03	MiMo-V2-Pro MiMo-V2-Pro medium Lansare: 2026-03-18

Metrică	Gemini 3.1 Flash Lite Preview Gemini 3.1 Flash Lite Preview low Lansare: 2026-03-03	MiMo-V2-Pro MiMo-V2-Pro medium Lansare: 2026-03-18
Scor	8.0	8.0
Rang	#17	#20
Consistență	10.0	8.5
Teste corecte
Rată de trecere pe încercare	70.6%	76.5%
Teste instabile	0	3
Rulări totale	51	45
Cost per rezultat	0.168	1.110
Cost total	$0.021	$0.123
Preț de intrare	$0.250 / 1M	$1.000 / 1M
Preț de ieșire	$1.500 / 1M	$3.000 / 1M
Tokenuri de ieșire	1,617	1,875
Tokenuri de raționament	7,686	26,959
Timp de răspuns (mediu)	3.28s	9.78s
Timp de răspuns (maxim)	11.91s	64.71s
Timp de răspuns (total)	55.80s	156.45s

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite Preview	8.3	10.0	75.0%	0		2.12s	462	1,638
MiMo-V2-Pro	10.0	10.0	100.0%	0		3.06s	223	1,107

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite Preview	3.0	10.0	0.0%	0		11.91s	225	762
MiMo-V2-Pro	4.7	1.6	66.7%	1		64.71s	380	14,186

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite Preview	10.0	10.0	100.0%	0		3.00s	291	696
MiMo-V2-Pro	7.3	5.8	83.3%	1		17.20s	260	7,484

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite Preview	5.3	10.0	33.3%	0		2.36s	18	1,212
MiMo-V2-Pro	5.3	10.0	33.3%	0		6.00s	155	1,048

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite Preview	4.0	10.0	0.0%	0		1.54s	69	384
MiMo-V2-Pro	10.0	10.0	100.0%	0		4.06s	198	424

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite Preview	10.0	10.0	100.0%	0		1.49s	72	753
MiMo-V2-Pro	9.9	10.0	100.0%	0		3.36s	83	667

Puzzle Solving	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite Preview	10.0	10.0	100.0%	0		2.76s	243	1,248
MiMo-V2-Pro	7.0	7.2	55.6%	1		4.71s	313	1,179

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite Preview	10.0	10.0	100.0%	0		9.54s	237	993
MiMo-V2-Pro	10.0	10.0	100.0%	0		8.19s	263	864

Comparație rapidă

Schimbă perechea de comparație

Gemini 3.1 Flash Lite PreviewlowvsQwen3.5-Flashmedium Gemini 3.1 Flash Lite PreviewlowvsGLM 5 Turbomedium Gemini 3 Flash PreviewnonevsMiMo-V2-Promedium Claude Sonnet 4.6mediumvsGemini 3.1 Flash Lite Previewlow Gemini 3.1 Flash Lite PreviewlowvsGPT-5.4medium Gemini 3.1 Flash Lite PreviewlowvsGrok 4.20 Betamedium Gemini 3.1 Flash Lite PreviewlowvsStep 3.5 FlashmediumDisponibil gratuit DeepSeek V3.2mediumvsGemini 3.1 Flash Lite Previewlow Gemini 3.1 Flash Lite PreviewnonevsMiMo-V2-Promedium GPT-5.2 ChatnonevsMiMo-V2-Promedium Gemini 3.1 Flash Lite PreviewlowvsGPT-5.2 Chatnone Gemini 3.1 Flash Lite PreviewlowvsGLM 5medium