AI BENCHY Compare

Google: Gemini 3.1 Flash Lite vs Z.ai: GLM 5.2

Rezumat

Comparație benchmark Gemini 3.1 Flash Lite vs GLM 5.2: Gemini 3.1 Flash Lite conduce la scorul mediu cu 7.8 vs 7.1. Gemini 3.1 Flash Lite are costul de benchmark mai mic, $0.071 vs $0.076. Gemini 3.1 Flash Lite este mai rapid cu 3.23s vs 6.34s, cu rate de reușită de 65.1% vs 60.3%.

Model recomandat: Gemini 3.1 Flash Lite - Are cel mai bun scor aici (7.8) și răspunde de aproximativ 2.0x mai rapid decât GLM 5.2.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-18

Metrică	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium Lansare: 2026-05-08	GLM 5.2 GLM 5.2 none Lansare: 2026-06-17

Metrică	Gemini 3.1 Flash Lite Gemini 3.1 Flash Lite medium Lansare: 2026-05-08	GLM 5.2 GLM 5.2 none Lansare: 2026-06-17
Scor	7.8	7.1
Rang	#34	#61
Fiabilitate	10.0	9.9
Consistență	9.2	9.6
Teste corecte
Rată de trecere pe încercare	65.1%	60.3%
Teste instabile	2	1
Rulări totale	63	63
Cost per rezultat	0.539	0.628
Cost total	$0.071	$0.076
Preț de intrare	$0.250 / 1M	$1.400 / 1M
Preț de ieșire	$1.500 / 1M	$4.400 / 1M
Total tokenuri de intrare	36,808	38,671
Tokenuri de ieșire	2,254	4,817
Tokenuri de raționament	38,300	0
Timp de răspuns (mediu)	3.23s	6.34s
Timp de răspuns (maxim)	10.87s	20.69s
Timp de răspuns (total)	67.80s	133.19s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#34 Gemini 3.1 Flash Lite

medium

Cost: $0.003
Timp: 5.3s
Tokenuri: 1,754 tok

#61 GLM 5.2

none

SVG invalid

Cost: $0.033
Timp: 87.7s
Tokenuri: 7,455 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	9.1	10.0	75.0%	0		2.39s	502	604	4,201
GLM 5.2	8.3	10.0	75.0%	0		3.70s	567	313	0

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	5.5	10.0	33.3%	0		3.81s	8,134	459	8,978
GLM 5.2	3.7	9.5	0.0%	0		7.55s	7,263	1,958	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		10.87s	12,873	327	7,401
GLM 5.2	10.0	10.0	100.0%	0		20.69s	14,296	1,489	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		2.60s	7,362	279	2,845
GLM 5.2	10.0	10.0	100.0%	0		7.17s	7,113	204	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	2.9	7.2	11.1%	1		3.16s	643	15	5,165
GLM 5.2	5.3	10.0	33.3%	0		6.50s	696	27	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		2.60s	488	84	1,142
GLM 5.2	6.1	3.1	66.7%	1		4.42s	480	82	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	9.9	10.0	100.0%	0		2.59s	623	75	3,320
GLM 5.2	9.8	10.0	100.0%	0		3.84s	642	66	0

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	7.6	7.2	77.8%	1		1.95s	568	165	2,450
GLM 5.2	7.7	10.0	66.7%	0		3.31s	618	265	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	10.0	10.0	100.0%	0		4.55s	5,457	234	921
GLM 5.2	10.0	10.0	100.0%	0		15.76s	6,807	400	0

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
Gemini 3.1 Flash Lite	3.0	10.0	0.0%	0		3.08s	158	12	1,877
GLM 5.2	3.0	10.0	0.0%	0		3.41s	189	13	0

Comparație rapidă

Schimbă perechea de comparație

Gemma 4 26B A4BmediumDisponibil gratuitvsGLM 5.2none Step 3.7 FlashhighvsGLM 5.2none Gemini 3.1 Flash LitemediumvsStep 3.7 Flashlow Kimi K2.7 CodemediumvsGLM 5.2none DeepSeek V4 ProhighvsGemini 3.1 Flash Litemedium Grok 4.20mediumvsGLM 5.2none Gemini 3 Flash PreviewlowvsGLM 5.2none Gemini 3.1 Flash LitemediumvsGPT-5.3 Chatnone MiMo-V2.5-PromediumvsGLM 5.2none Seed-2.0-MinimediumvsGLM 5.2none Qwen3.5-FlashmediumvsGLM 5.2none Gemini 3.5 FlashminimalvsGLM 5.2none