AI BENCHY Compare

Xiaomi: MiMo-V2.5 vs Z.ai: GLM 5.2

Rezumat

Comparație benchmark MiMo-V2.5 vs GLM 5.2: GLM 5.2 conduce la scorul mediu cu 7.1 vs 6.7. MiMo-V2.5 are costul de benchmark mai mic, $0.063 vs $0.076. GLM 5.2 este mai rapid cu 6.34s vs 27.11s, cu rate de reușită de 69.8% vs 60.3%.

Model recomandat: GLM 5.2 - Are cel mai bun scor aici (7.1) și răspunde de aproximativ 4.3x mai rapid decât MiMo-V2.5.

Benchmark-urile au fost generate din suitele de teste AI BENCHY la: 2026-06-18

Metrică	MiMo-V2.5 MiMo-V2.5 medium Lansare: 2026-04-22	GLM 5.2 GLM 5.2 none Lansare: 2026-06-17

Metrică	MiMo-V2.5 MiMo-V2.5 medium Lansare: 2026-04-22	GLM 5.2 GLM 5.2 none Lansare: 2026-06-17
Scor	6.7	7.1
Rang	#76	#61
Fiabilitate	10.0	9.9
Consistență	8.1	9.6
Teste corecte
Rată de trecere pe încercare	69.8%	60.3%
Teste instabile	5	1
Rulări totale	63	63
Cost per rezultat	2.966	0.628
Cost total	$0.063	$0.076
Preț de intrare	$0.140 / 1M	$1.400 / 1M
Preț de ieșire	$0.280 / 1M	$4.400 / 1M
Total tokenuri de intrare	41,838	38,671
Tokenuri de ieșire	2,827	4,817
Tokenuri de raționament	198,898	0
Timp de răspuns (mediu)	27.11s	6.34s
Timp de răspuns (maxim)	162.44s	20.69s
Timp de răspuns (total)	569.38s	133.19s

Prezentare generare

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#76 MiMo-V2.5

medium

Cost: $0.002
Timp: 54.8s
Tokenuri: 5,247 tok

#61 GLM 5.2

none

SVG invalid

Cost: $0.033
Timp: 87.7s
Tokenuri: 7,455 tok

Top modele după scor

Scor vs cost total

Timp de răspuns (mediu)

Scor vs Timp de răspuns (mediu)

Total tokenuri de ieșire

Scor vs Total tokenuri de ieșire

Defalcare pe categorii

Trucuri anti-AI	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
MiMo-V2.5	10.0	10.0	100.0%	0		4.14s	621	281	1,739
GLM 5.2	8.3	10.0	75.0%	0		3.70s	567	313	0

Programare	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
MiMo-V2.5	6.2	4.7	66.7%	2		97.14s	7,422	557	81,977
GLM 5.2	3.7	9.5	0.0%	0		7.55s	7,263	1,958	0

Combinat	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
MiMo-V2.5	10.0	10.0	100.0%	0		16.86s	15,060	363	7,609
GLM 5.2	10.0	10.0	100.0%	0		20.69s	14,296	1,489	0

Parsare și extragere de date	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
MiMo-V2.5	2.7	5.7	16.7%	1		6.33s	7,746	306	5,714
GLM 5.2	10.0	10.0	100.0%	0		7.17s	7,113	204	0

Specific domeniului	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
MiMo-V2.5	5.3	10.0	33.3%	0		34.53s	735	507	49,478
GLM 5.2	5.3	10.0	33.3%	0		6.50s	696	27	0

Inteligență generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
MiMo-V2.5	5.4	2.5	66.7%	1		5.37s	492	121	418
GLM 5.2	6.1	3.1	66.7%	1		4.42s	480	82	0

Respectarea instrucțiunilor	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
MiMo-V2.5	9.9	10.0	100.0%	0		1.80s	672	88	801
GLM 5.2	9.8	10.0	100.0%	0		3.84s	642	66	0

Rezolvare de puzzle-uri	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
MiMo-V2.5	8.2	7.2	88.9%	1		20.25s	660	279	33,254
GLM 5.2	7.7	10.0	66.7%	0		3.31s	618	265	0

Apelare instrumente	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
MiMo-V2.5	10.0	10.0	100.0%	0		7.29s	8,220	303	2,424
GLM 5.2	10.0	10.0	100.0%	0		15.76s	6,807	400	0

Cultură generală	Scor	Consistență	Rată de trecere pe încercare	Teste instabile	Teste corecte	Timp de răspuns (mediu)	Tokenuri de intrare	Tokenuri de ieșire	Tokenuri de raționament
MiMo-V2.5	3.0	10.0	0.0%	0		51.29s	210	22	15,484
GLM 5.2	3.0	10.0	0.0%	0		3.41s	189	13	0

Comparație rapidă

Schimbă perechea de comparație

Gemma 4 26B A4BmediumDisponibil gratuitvsGLM 5.2none Step 3.7 FlashhighvsGLM 5.2none Gemini 3.5 FlashminimalvsMiMo-V2.5medium Kimi K2.7 CodemediumvsGLM 5.2none Qwen3.7 MaxnonevsMiMo-V2.5medium Gemini 3 Flash PreviewnonevsMiMo-V2.5medium Grok 4.20mediumvsGLM 5.2none Gemini 3.1 Flash Lite PreviewlowvsMiMo-V2.5medium Gemini 3 Flash PreviewlowvsGLM 5.2none Gemini 3.5 FlashnonevsMiMo-V2.5medium Gemini 3.1 Flash Lite PreviewnonevsMiMo-V2.5medium MiMo-V2.5-PromediumvsGLM 5.2none