编程 排名
看看哪些 AI 模型在 编程 上表现最好,哪些更稳定,以及差距主要出现在哪里。
408/408
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 编程 得分 | 分数 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #225 | Qwen3.5-35B-A3B medium | Qwen | 0.6 | 0.6 | $0.716 | 1/3 | 206.6s |
| #149 | Qwen3.5-27B none | Qwen | 0.6 | 0.7 | $0.116 | 1/3 | 1.80s |
| #222 | Dots 3 Note Preview high | Dots Studio | 0.6 | 0.6 | $0.000 | 1/3 | 306.2s |
| #186 | Solar Pro 4 xhigh | Upstage | 0.6 | 0.7 | $0.067 | 1/3 | 292.2s |
| #172 | Gemini 3 Flash Preview low | 0.6 | 0.7 | $0.254 | 1/3 | 6.00s | |
| #185 | Space Bunny Alpha max | Stealth | 0.6 | 0.7 | $0.000 | 1/3 | 17.1s |
| #233 | Claude Opus 4.6 medium | Anthropic | 0.6 | 0.6 | $2.961 | 1/3 | 30.1s |
| #217 | Claude Sonnet 4.6 medium | Anthropic | 0.6 | 0.6 | $2.126 | 1/3 | 33.3s |
| #230 | Solar Pro 4 high | Upstage | 0.6 | 0.6 | $0.077 | 1/3 | 244.7s |
| #180 | Kimi K2.6 medium | Moonshot AI | 0.6 | 0.7 | $1.594 | 1/3 | 214.4s |
| #188 | Grok Build 0.1 medium | X AI | 0.6 | 0.7 | $1.419 | 1/3 | 108.5s |
| #320 | MiniMax M2.7 medium | Minimax | 0.6 | 0.5 | $0.326 | 1/3 | 101.9s |
| #350 | Owl Alpha default | Openrouter | 0.6 | 0.5 | $0.000 | 1/3 | 36.9s |
| #232 | Ling 3.1 Flash low | Inclusionai | 0.6 | 0.6 | $0.000 | 1/3 | 107.3s |
| #220 | Gemini 3.5 Flash minimal | 0.6 | 0.6 | $0.508 | 1/3 | 2.75s |