AI BENCHY Compare

ByteDance Seed: Seed-2.0-Lite vs Z.ai: GLM 5 Turbo

Last updated at: 2026-03-15

Metric	Seed-2.0-Lite Seed-2.0-Lite none Release: 2026-02-14	GLM 5 Turbo GLM 5 Turbo medium Release: 2026-03-15

Metric	Seed-2.0-Lite Seed-2.0-Lite none Release: 2026-02-14	GLM 5 Turbo GLM 5 Turbo medium Release: 2026-03-15
Rank	#43	#20
Score	6.2	7.9
Consistency	7.4	7.7
Cost per result	0.214	1.641
Total Cost	$0.015	$0.165
Tests Correct
Attempt pass rate	56.3%	75.0%
Flaky tests	5	5
Total Runs	48	48
Output Tokens	2,743	11,853
Reasoning Tokens	0	35,095
Response Time (avg)	2.49s	18.84s
Response Time (max)	6.70s	194.23s
Response Time (total)	39.91s	301.50s

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Anti-AI Tricks	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Seed-2.0-Lite	3.0	4.6	22.2%	2		2.93s	703	0
GLM 5 Turbo	10.0	10.0	100.0%	0		5.01s	350	2,600

Combined	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Seed-2.0-Lite	3.0	10.0	0.0%	0		6.59s	498	0
GLM 5 Turbo	10.0	10.0	100.0%	0		13.88s	390	2,037

Data parsing and extraction	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.82s	246	0
GLM 5 Turbo	10.0	10.0	100.0%	0		6.19s	577	3,632

Domain specific	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Seed-2.0-Lite	3.6	7.2	22.2%	1		1.33s	17	0
GLM 5 Turbo	2.9	4.4	22.2%	2		71.07s	9,665	19,279

General Intelligence	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.45s	294	0
GLM 5 Turbo	6.1	3.1	66.7%	1		10.05s	60	2,216

Instructions following	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Seed-2.0-Lite	10.0	10.0	100.0%	0		1.06s	73	0
GLM 5 Turbo	10.0	10.0	100.0%	0		5.38s	255	2,183

Puzzle Solving	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Seed-2.0-Lite	5.2	4.4	55.6%	2		2.46s	620	0
GLM 5 Turbo	7.3	5.8	55.6%	2		5.44s	315	2,702

Tool Calling	Score	Consistency	Attempt pass rate	Flaky tests	Tests Correct	Response Time (avg)	Output Tokens	Reasoning Tokens
Seed-2.0-Lite	10.0	10.0	100.0%	0		3.94s	292	0
GLM 5 Turbo	10.0	10.0	100.0%	0		9.84s	241	446

Quick Compare

Switch Comparison Pair

Seed-2.0-Litenonevsgpt-oss-120bmediumFree Available Gemini 3 Flash PreviewnonevsGLM 5 Turbomedium Gemini 3.1 Flash Lite PreviewlowvsGLM 5 Turbomedium GPT-5.3 ChatnonevsGLM 5 Turbomedium GPT-5.2 ChatnonevsGLM 5 Turbomedium Seed-2.0-LitenonevsGrok 4.20 Multi-Agent Betamedium Seed-2.0-LitenonevsMiniMax M2.5mediumFree Available Gemini 3.1 Flash Lite PreviewnonevsGLM 5 Turbomedium Seed-2.0-LitenonevsGPT-5 Nanomedium Seed-2.0-LitenonevsMercury 2medium Claude Sonnet 4.6nonevsGLM 5 Turbomedium Seed-2.0-LitenonevsNemotron 3 Super 120b A12bmediumFree Available