编程 排名
看看哪些 AI 模型在 编程 上表现最好,哪些更稳定,以及差距主要出现在哪里。 排序方式: 响应时间(平均) ↑.
408/408
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 编程 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #242 | DeepSeek V4 Flash 0731 none | DeepSeek | 0.4 | 0.6 | $0.053 | 0/3 | 1.72s |
| #262 | Qwen3.6 Flash none | Qwen | 0.5 | 0.6 | $0.139 | 1/3 | 1.79s |
| #391 | Grok 4.1 Fast default | X AI | 0.2 | 0.3 | $0.008 | 0/1 | 1.79s |
| #149 | Qwen3.5-27B none | Qwen | 0.6 | 0.7 | $0.116 | 1/3 | 1.80s |
| #215 | Gemini 3 Flash Preview none | 0.5 | 0.6 | $0.155 | 1/3 | 1.80s | |
| #298 | Ember-1 none | Fireworks | 0.5 | 0.5 | $0.786 | 1/3 | 1.94s |
| #392 | Laguna Xs.2 default | Poolside | 0.8 | 0.3 | $0.004 | 0/1 | 1.96s |
| #202 | Mercury 2 medium | Inception | 0.8 | 0.7 | $0.121 | 2/3 | 2.04s |
| #231 | Qwen3.5 Plus 2026-02-15 none | Qwen | 0.4 | 0.6 | $0.176 | 0/3 | 2.05s |
| #115 | Qwen3.7 Plus none | Qwen | 0.5 | 0.8 | $0.178 | 1/3 | 2.15s |
| #343 | GPT-5.4 Nano none | OpenAI | 0.5 | 0.5 | $0.068 | 0/3 | 2.22s |
| #326 | Qwen3 Coder Next default | Qwen | 0.5 | 0.5 | $0.067 | 0/3 | 2.22s |
| #275 | Seed 2.1 Turbo none | Bytedance Seed | 0.5 | 0.6 | $0.182 | 0/3 | 2.35s |
| #365 | GLM 5 Turbo none | Z.ai | 0.4 | 0.4 | $0.047 | 0/3 | 2.41s |
| #335 | GLM 4.7 Flash none | Z.ai | 0.4 | 0.5 | $0.027 | 0/3 | 2.54s |