已对比模型

排名: #49
总输出令牌: 124,566
响应时间（平均）: 33.54s
总成本: $0.307

排名: #82
总输出令牌: 152,552
响应时间（平均）: 46.77s
总成本: $0.535

排名: #152
总输出令牌: 1,989
响应时间（平均）: 4.03s
总成本: $0.041

排名: #163
总输出令牌: 14,393
响应时间（平均）: 6.70s
总成本: $0.164

推荐模型 GLM 5 (medium)

它在本次比较中得分最高（7.7），并且在全部 4 个模型中兼顾成本和响应时间最好。

详细对比

指标	GLM 5 GLM 5 medium 发布日期: 2026-02-12	GLM 5.1 GLM 5.1 medium 发布日期: 2026-04-07	GLM 5 GLM 5 none 发布日期: 2026-02-12	GLM 5.1 GLM 5.1 none 发布日期: 2026-04-07

指标	GLM 5 GLM 5 medium 发布日期: 2026-02-12	GLM 5.1 GLM 5.1 medium 发布日期: 2026-04-07	GLM 5 GLM 5 none 发布日期: 2026-02-12	GLM 5.1 GLM 5.1 none 发布日期: 2026-04-07
分数	7.7	7.1	5.7	5.5
排名	#49	#82	#152	#163
可靠性	10.0	8.3	10.0	10.0
一致性	8.1	8.4	9.3	8.2
测试正确
尝试通过率	78.8%	69.7%	42.4%	40.9%
不稳定测试	4	4	1	5
总运行次数	63	66	63	66
每个结果成本	1.668	4.202	0.263	2.368
总成本	$0.307	$0.535	$0.041	$0.164
输入价格	$0.950 / 1M	$0.966 / 1M	$0.950 / 1M	$0.966 / 1M
输出价格	$2.551 / 1M	$3.036 / 1M	$2.551 / 1M	$3.036 / 1M
总输入令牌	35,224	82,623	37,135	124,209
输出令牌	21,570	16,089	1,989	14,393
推理令牌	102,996	136,463	0	0
响应时间（平均）	33.54s	46.77s	4.03s	6.70s
响应时间（最大）	99.85s	308.75s	11.07s	61.20s
响应时间（总计）	435.99s	982.16s	56.37s	147.38s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#49 GLM 5

medium

成本: $0.005
时间: 20.7s
令牌: 2,068 tok

#82 GLM 5.1

medium

无效SVG

成本: $0.000
时间: 300.0s
令牌: 0 tok

#152 GLM 5

none

成本: $0.007
时间: 32.1s
令牌: 2,023 tok

#163 GLM 5.1

none

无效SVG

成本: $0.000
时间: 300.0s
令牌: 0 tok

按分数排名的模型

分数 vs 总成本

响应时间（平均）

分数 vs 响应时间（平均）

总输出令牌

分数 vs 总输出令牌

类别细分

类别:

反AI技巧	分数	一致性	尝试通过率	不稳定测试	测试正确	响应时间（平均）	输入令牌	输出令牌	推理令牌
GLM 5	10.0	10.0	100.0%	0		23.66s	555	480	7,056
GLM 5.1	10.0	10.0	100.0%	0		8.31s	555	401	5,122
GLM 5	4.8	10.0	25.0%	0		2.37s	510	275	0
GLM 5.1	4.0	6.3	25.0%	2		2.11s	555	305	0

编程	分数	一致性	尝试通过率	不稳定测试	测试正确	响应时间（平均）	输入令牌	输出令牌	推理令牌
GLM 5	10.0	10.0	100.0%	0		74.30s	7,254	2,997	52,930
GLM 5.1	4.6	3.7	44.5%	2		109.63s	5,702	4,871	37,826
GLM 5	4.0	7.8	11.1%	1		5.12s	7,256	428	0
GLM 5.1	3.9	9.7	0.0%	0		4.96s	7,256	525	0

综合	分数	一致性	尝试通过率	不稳定测试	测试正确	响应时间（平均）	输入令牌	输出令牌	推理令牌
GLM 5	5.0	5.0	50.0%	0		28.96s	12,804	662	3,242
GLM 5.1	9.8	10.0	100.0%	0		175.93s	66,926	4,761	65,248
GLM 5	1.5	5.0	0.0%	0		4.98s	12,812	406	0
GLM 5.1	2.8	1.8	33.3%	2		46.88s	99,907	12,768	0

数据解析与提取	分数	一致性	尝试通过率	不稳定测试	测试正确	响应时间（平均）	输入令牌	输出令牌	推理令牌
GLM 5	7.1	5.6	83.3%	1		8.90s	5,508	567	3,734
GLM 5.1	10.0	10.0	100.0%	0		9.33s	7,107	991	4,552
GLM 5	10.0	10.0	100.0%	0		5.78s	7,107	203	0
GLM 5.1	10.0	10.0	100.0%	0		1.08s	7,107	204	0

领域专项	分数	一致性	尝试通过率	不稳定测试	测试正确	响应时间（平均）	输入令牌	输出令牌	推理令牌
GLM 5	3.5	4.4	33.3%	2		0ms	260	13,176	14,137
GLM 5.1	5.3	10.0	33.3%	0		29.77s	489	969	11,314
GLM 5	3.0	10.0	0.0%	0		2.24s	643	19	0
GLM 5.1	2.9	7.2	11.1%	1		1.99s	687	24	0

通用智能	分数	一致性	尝试通过率	不稳定测试	测试正确	响应时间（平均）	输入令牌	输出令牌	推理令牌
GLM 5	6.1	3.1	66.7%	1		14.69s	477	2,020	2,248
GLM 5.1	10.0	10.0	100.0%	0		20.95s	477	2,875	2,875
GLM 5	10.0	10.0	100.0%	0		3.27s	477	103	0
GLM 5.1	5.0	10.0	0.0%	0		790ms	477	39	0

指令遵循	分数	一致性	尝试通过率	不稳定测试	测试正确	响应时间（平均）	输入令牌	输出令牌	推理令牌
GLM 5	10.0	10.0	100.0%	0		7.25s	636	1,001	2,129
GLM 5.1	6.4	5.8	66.7%	1		7.47s	634	204	1,617
GLM 5	10.0	10.0	100.0%	0		1.48s	636	61	0
GLM 5.1	9.8	10.0	100.0%	0		1.98s	636	66	0

谜题求解	分数	一致性	尝试通过率	不稳定测试	测试正确	响应时间（平均）	输入令牌	输出令牌	推理令牌
GLM 5	10.0	10.0	100.0%	0		11.33s	609	33	4,076
GLM 5.1	8.2	7.2	88.9%	1		31.64s	609	935	5,730
GLM 5	7.7	10.0	66.7%	0		1.91s	609	261	0
GLM 5.1	7.7	10.0	66.7%	0		1.45s	609	151	0

工具调用	分数	一致性	尝试通过率	不稳定测试	测试正确	响应时间（平均）	输入令牌	输出令牌	推理令牌
GLM 5	10.0	10.0	100.0%	0		15.93s	6,935	233	994
GLM 5.1	3.0	10.0	0.0%	0		0ms	0	0	0
GLM 5	10.0	10.0	100.0%	0		11.07s	6,899	220	0
GLM 5.1	10.0	10.0	100.0%	0		10.68s	6,789	300	0

常识问答	分数	一致性	尝试通过率	不稳定测试	测试正确	响应时间（平均）	输入令牌	输出令牌	推理令牌
GLM 5	3.0	10.0	0.0%	0		67.37s	186	401	12,450
GLM 5.1	3.0	10.0	0.0%	0		29.40s	124	82	2,179
GLM 5	3.0	10.0	0.0%	0		3.62s	186	13	0
GLM 5.1	3.0	10.0	0.0%	0		2.34s	186	11	0

快速对比

切换对比组合

Nemotron 3 Supermedium免费可用vsGLM 5none KAT-Coder-Air V2.5mediumvsGLM 5.1none GPT-5.6 LunahighvsGLM 5medium Claude Opus 4.8lowvsGLM 5medium Qwen3.7 PlusnonevsGLM 5.1medium DeepSeek V4 FlashhighvsGLM 5medium DeepSeek V4 ProhighvsGLM 5medium KAT-Coder-Air V2.5highvsGLM 5none KAT-Coder-Air V2.5highvsGLM 5.1none KAT-Coder-Pro V2.5highvsGLM 5.1medium Step 3.7 FlashlowvsGLM 5.1medium Gemini 3.5 FlashnonevsGLM 5.1medium