比较图表

语言:

❤️ Made by XCS

AI BENCHY 对比

Google: Gemini 3.1 Flash Lite Preview vs Z.ai: GLM 5

比较:

基准结果生成自 AI BENCHY 测试套件，时间：: 2026-03-03

指标	Google: Gemini 3.1 Flash Lite Preview none 发布日期: 2026-03-03	Z.ai: GLM 5 medium 发布日期: 2026-02-12
排名	#10	#13
平均分	7.70	7.29
一致性	9.54	8.18
每个结果成本	0.116	1.196
总成本	$0.011	$0.120
测试正确
尝试通过率	69.1%	83.3%
不稳定测试	1	3
输出令牌	4,307	15,923
推理令牌	0	42,557

按分数排名的模型

分数 vs 总成本

类别细分

反AI技巧	分数	一致性	尝试通过率	不稳定测试	测试正确	输出令牌	推理令牌
Google: Gemini 3.1 Flash Lite Preview	6.00	7.85	55.6%	1		1,086	0
Z.ai: GLM 5	10.00	10.00	100.0%	0		420	4,992

数据解析与提取	分数	一致性	尝试通过率	不稳定测试	测试正确	输出令牌	推理令牌
Google: Gemini 3.1 Flash Lite Preview	9.88	10.00	100.0%	0		399	0
Z.ai: GLM 5	5.00	5.62	83.3%	1		567	3,734

领域专项	分数	一致性	尝试通过率	不稳定测试	测试正确	输出令牌	推理令牌
Google: Gemini 3.1 Flash Lite Preview	4.00	10.00	33.3%	0		568	0
Z.ai: GLM 5	1.00	4.41	33.3%	2		14,404	24,570

指令遵循	分数	一致性	尝试通过率	不稳定测试	测试正确	输出令牌	推理令牌
Google: Gemini 3.1 Flash Lite Preview	9.00	10.00	50.0%	0		574	0
Z.ai: GLM 5	9.50	9.99	100.0%	0		140	2,740

Puzzle Solving	分数	一致性	尝试通过率	不稳定测试	测试正确	输出令牌	推理令牌
Google: Gemini 3.1 Flash Lite Preview	10.00	10.00	100.0%	0		898	0
Z.ai: GLM 5	10.00	10.00	100.0%	0		159	5,527

工具调用	分数	一致性	尝试通过率	不稳定测试	测试正确	输出令牌	推理令牌
Google: Gemini 3.1 Flash Lite Preview	10.00	10.00	100.0%	0		782	0
Z.ai: GLM 5	10.00	10.00	100.0%	0		233	994

快速对比

切换对比组合

GPT-5.3 ChatnonevsGLM 5medium Gemini 3 Flash PreviewnonevsGLM 5medium GPT-5.2 ChatnonevsGLM 5medium Gemini 3.1 Flash Lite PreviewnonevsGPT-5.3-Codexmedium Claude Sonnet 4.6mediumvsGemini 3.1 Flash Lite Previewnone Gemini 3.1 Flash Lite PreviewhighvsGLM 5medium Gemini 3.1 Flash Lite PreviewlowvsGLM 5medium Gemini 3.1 Flash Lite PreviewnonevsStep 3.5 Flashmedium免费可用 DeepSeek V3.2mediumvsGemini 3.1 Flash Lite Previewnone Gemini 3.1 Flash Lite PreviewnonevsGPT-5.2medium Gemini 3.1 Flash Lite PreviewnonevsQwen3.5-27Bmedium Gemini 3.1 Flash Lite PreviewnonevsQwen3.5-122B-A10Bmedium