编程 排名
看看哪些 AI 模型在 编程 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 指标 ↑.
408/408
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 编程 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #155 | LongCat 2.0 medium | Meituan | 1.0 | 0.7 | $0.767 | 3/3 | 455.0s |
| #156 | GLM 5 medium | Z.ai | 1.0 | 0.7 | $0.479 | 3/3 | 74.3s |
| #168 | Ember-1 low | Fireworks | 1.0 | 0.7 | $1.488 | 3/3 | 37.9s |