编程 排名
看看哪些 AI 模型在 编程 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 指标 ↑.
408/408
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 编程 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #303 | Qwen3.6 Max Preview none | Qwen | 0.4 | 0.5 | $0.228 | 0/3 | 3.12s |
| #346 | Laguna S 2.1 low | Poolside | 0.4 | 0.5 | $0.108 | 0/3 | 167.5s |
| #210 | GLM 5.1 none | Z.ai | 0.4 | 0.6 | $0.451 | 0/3 | 4.96s |
| #338 | North Mini Code default | Cohere | 0.4 | 0.5 | $0.000 | 0/3 | 22.0s |
| #249 | Qwen3.5 Plus 2026-04-20 none | Qwen | 0.4 | 0.6 | $0.216 | 0/3 | 1.69s |
| #331 | Qwen3.5-9B none | Qwen | 0.4 | 0.5 | $0.041 | 0/3 | 5.60s |
| #365 | GLM 5 Turbo none | Z.ai | 0.4 | 0.4 | $0.047 | 0/3 | 2.41s |
| #203 | Step 3.7 Flash high | Stepfun | 0.4 | 0.7 | $1.478 | 0/3 | 206.2s |
| #282 | GLM 5 none | Z.ai | 0.4 | 0.6 | $0.140 | 0/3 | 5.12s |
| #347 | Nemotron 3.5 Lightning low | NVIDIA | 0.4 | 0.5 | $0.175 | 0/3 | 224.4s |
| #381 | Elephant Alpha default | Openrouter | 0.4 | 0.4 | $0.000 | 0/3 | 1.39s |
| #373 | Ling 3.0 Tiny default | Inclusionai | 0.4 | 0.4 | $0.000 | 0/3 | 1.19s |
| #276 | Dots 3 Note Preview medium | Dots Studio | 0.4 | 0.6 | $0.000 | 0/3 | 309.1s |
| #237 | DeepSeek V4 Flash 0423 none | DeepSeek | 0.4 | 0.6 | $0.149 | 0/3 | 17.1s |
| #227 | Gemini 3.5 Flash Lite low | 0.4 | 0.6 | $0.183 | 0/3 | 917ms |