编程 排名
看看哪些 AI 模型在 编程 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 测试正确 ↓.
408/408
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 编程 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #311 | MiMo-V2-Flash medium | Xiaomi | 0.6 | 0.5 | $0.043 | 1/3 | 10.7s |
| #314 | Mercury 2.5 low | Inception | 0.5 | 0.5 | $0.020 | 1/3 | 972ms |
| #318 | Laguna S 2.1 medium | Poolside | 0.5 | 0.5 | $0.092 | 1/3 | 159.0s |
| #319 | Mercury 2.5 Preview low | Inception | 0.5 | 0.5 | $0.015 | 1/3 | 972ms |
| #320 | MiniMax M2.7 medium | Minimax | 0.6 | 0.5 | $0.326 | 1/3 | 101.9s |
| #327 | Laguna S 2.1 high | Poolside | 0.5 | 0.5 | $0.145 | 1/3 | 271.4s |
| #330 | MiMo-V2.5 none | Xiaomi | 0.5 | 0.5 | $0.049 | 1/3 | 3.24s |
| #334 | Hy3 preview high | Tencent | 0.5 | 0.5 | $0.135 | 1/3 | 99.8s |
| #345 | GLM 5V Turbo none | Z.ai | 0.5 | 0.5 | $0.052 | 1/3 | 3.13s |
| #348 | Owl Alpha medium | Openrouter | 0.5 | 0.5 | $0.000 | 1/3 | 18.7s |
| #349 | Mimo V2 PRO default | Xiaomi | 0.5 | 0.5 | $0.045 | 1/3 | 2.65s |
| #350 | Owl Alpha default | Openrouter | 0.6 | 0.5 | $0.000 | 1/3 | 36.9s |
| #351 | Ling 2.6 Flash default | Inclusionai | 0.5 | 0.5 | $0.002 | 1/3 | 11.2s |
| #352 | Hy3 preview low | Tencent | 0.5 | 0.5 | $0.042 | 1/3 | 27.9s |
| #353 | Ring 2.6 1t default | Inclusionai | 0.5 | 0.4 | $0.026 | 1/3 | 143.8s |