AI BENCHY Compare

Xiaomi: MiMo-V2-Pro vs Z.ai: GLM 5.1

Last updated at: 2026-04-07

Metric	MiMo-V2-Pro MiMo-V2-Pro medium Release: 2026-03-18	GLM 5.1 GLM 5.1 medium Release: 2026-04-07

Metric	MiMo-V2-Pro MiMo-V2-Pro medium Release: 2026-03-18	GLM 5.1 GLM 5.1 medium Release: 2026-04-07
Score	8.0	8.0
Rank	#25	#23
Consistency	8.5	9.0
Tests Correct
Attempt pass rate	76.5%	76.5%
Flaky tests	3	2
Total Runs	45	51
Cost per result	1.110	1.270
Total Cost	$0.123	$0.153
Input Price	$1.000 / 1M	$1.000 / 1M
Output Price	$3.000 / 1M	$3.200 / 1M
Output Tokens	1,875	6,666
Reasoning Tokens	26,959	35,313
Response Time (avg)	9.78s	18.23s
Response Time (max)	64.71s	43.11s
Response Time (total)	156.45s	291.73s

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Anti-AI Tricks	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
MiMo-V2-Pro	10.0	10.0	100.0%	0		3.06s	223	1,107
GLM 5.1	10.0	10.0	100.0%	0		8.31s	401	5,122

Combined	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
MiMo-V2-Pro	4.7	1.6	66.7%	1		64.71s	380	14,186
GLM 5.1	9.5	10.0	100.0%	0		43.11s	327	4,206

Data parsing and extraction	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
MiMo-V2-Pro	7.3	5.8	83.3%	1		17.20s	260	7,484
GLM 5.1	10.0	10.0	100.0%	0		9.33s	991	4,552

Domain specific	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
MiMo-V2-Pro	5.3	10.0	33.3%	0		6.00s	155	1,048
GLM 5.1	5.3	10.0	33.3%	0		29.77s	969	11,314

General Intelligence	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
MiMo-V2-Pro	10.0	10.0	100.0%	0		4.06s	198	424
GLM 5.1	10.0	10.0	100.0%	0		20.95s	2,875	2,875

Instructions following	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
MiMo-V2-Pro	9.9	10.0	100.0%	0		3.36s	83	667
GLM 5.1	6.4	5.8	66.7%	1		7.47s	204	1,617

Puzzle Solving	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
MiMo-V2-Pro	7.0	7.2	55.6%	1		4.71s	313	1,179
GLM 5.1	8.2	7.2	88.9%	1		23.85s	899	5,627

Tool Calling	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
MiMo-V2-Pro	10.0	10.0	100.0%	0		8.19s	263	864
GLM 5.1	3.0	10.0	0.0%	0		0ms	0	0

Quick Compare

Switch Comparison Pair

Gemini 3 Flash PreviewnonevsGLM 5.1medium Gemini 3.1 Flash Lite PreviewlowvsGLM 5.1medium Gemini 3 Flash PreviewnonevsMiMo-V2-Promedium Gemini 3.1 Flash Lite PreviewlowvsMiMo-V2-Promedium Gemini 3.1 Flash Lite PreviewnonevsMiMo-V2-Promedium GPT-5.2 ChatnonevsMiMo-V2-Promedium Gemini 3.1 Flash Lite PreviewnonevsGLM 5.1medium GPT-5.2 ChatnonevsGLM 5.1medium GPT-5.3 ChatnonevsMiMo-V2-Promedium GPT-5.3 ChatnonevsGLM 5.1medium Claude Sonnet 4.6nonevsMiMo-V2-Promedium Gemini 3 Flash PreviewlowvsGLM 5.1medium