- 排名
- #92
- 总输出令牌
- 124,566
- 响应时间(平均)
- 33.54s
- 总成本
- $0.228
已对比模型
GLM 5 (medium) vs GLM 5.1 (medium) vs GLM 5 vs GLM 5.1 基准对比: GLM 5 (medium) 在分数上以 7.7 领先。 GLM 5 (medium) 在可靠性上以 10.0 领先。 GLM 5 的总成本最低,为 $0.027。 GLM 5 最快,为 4.03s。
已对比模型
- 排名
- #142
- 总输出令牌
- 215,889
- 响应时间(平均)
- 58.80s
- 总成本
- $0.727
- 排名
- #227
- 总输出令牌
- 1,989
- 响应时间(平均)
- 4.03s
- 总成本
- $0.027
- 排名
- #230
- 总输出令牌
- 14,393
- 响应时间(平均)
- 6.74s
- 总成本
- $0.164
推荐模型
GLM 5
它提供了最佳整体取舍:得分有竞争力(5.7),成本低于本次比较中的其他模型,响应时间也较均衡。
详细对比
| 指标 | GLM 5 GLM 5 medium | GLM 5.1 GLM 5.1 medium | GLM 5 GLM 5 none | GLM 5.1 GLM 5.1 none |
|---|---|---|---|---|
| 分数 | 7.7 | 7.0 | 5.7 | 5.7 |
| 排名 | #92 | #142 | #227 | #230 |
| 可靠性 | 10.0 | 8.1 | 10.0 | 10.0 |
| 一致性 | 8.1 | 8.4 | 9.3 | 8.2 |
| 尝试次数 | 63/66 | 66/66 | 63/66 | 66/66 |
| 测试正确 | ||||
| 尝试通过率 | 78.8% | 65.2% | 42.4% | 45.5% |
| 不稳定测试 | 4 | 4 | 1 | 5 |
| 总运行次数 | 63 | 66 | 63 | 66 |
| 每个结果成本 | 1.668 | 6.923 | 0.263 | 2.073 |
| 总成本 | $0.228 | $0.727 | $0.027 | $0.164 |
| 输入价格 | $0.600 / 1M | $0.966 / 1M | $0.600 / 1M | $0.966 / 1M |
| 输出价格 | $1.920 / 1M | $3.036 / 1M | $1.920 / 1M | $3.036 / 1M |
| 总输入令牌 | 35,224 | 82,592 | 37,135 | 124,219 |
| 输出令牌 | 21,570 | 16,089 | 1,989 | 14,393 |
| 推理令牌 | 102,996 | 199,800 | 0 | 0 |
| 响应时间(平均) | 33.54s | 58.80s | 4.03s | 6.74s |
| 响应时间(最大) | 99.85s | 308.75s | 11.07s | 61.20s |
| 响应时间(总计) | 435.99s | 1234.72s | 56.37s | 148.20s |
| 参数量 | 744B 总计 (40B 激活) | 744B 总计 (40B 激活) | 744B 总计 (40B 激活) | 744B 总计 (40B 激活) |
| 开放状态 | 开源 | 开源 | 开源 | 开源 |
模型生成展示
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#92 GLM 5
medium- 成本
- $0.005
- 时间
- 20.7s
- 令牌
- 2,068 tok
#142 GLM 5.1
medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
- 成本
- $0.000
- 时间
- 300.0s
- 令牌
- 0 tok
#227 GLM 5
none- 成本
- $0.007
- 时间
- 32.1s
- 令牌
- 2,023 tok
#230 GLM 5.1
none
Reached the allocated time limit (300 seconds) without receiving showcase output.
- 成本
- $0.000
- 时间
- 300.0s
- 令牌
- 0 tok
按分数排名的模型
分数 vs 总成本
响应时间(平均)
分数 vs 响应时间(平均)
总输出令牌
分数 vs 总输出令牌
类别细分
快速对比
切换对比组合
Seed-2.0-CodelowvsGLM 5mediumGPT-5.5nonevsGLM 5.1mediumNemotron 3 Supermedium免费可用vsGLM 5noneInkling SmalllowvsGLM 5noneNorth Mini Codemedium免费可用vsGLM 5noneInkling SmalllowvsGLM 5.1noneKAT-Coder-Air V2.5highvsGLM 5.1noneQwen3.7 FlashhighvsGLM 5mediumClaude Opus 4.8lowvsGLM 5mediumGPT-5.6 SolnonevsGLM 5.1mediumNemotron 3 Supermedium免费可用vsGLM 5.1noneDeepSeek V4 ProhighvsGLM 5medium