编程:无答案
编程
无答案
看看哪些 AI 模型在 编程 上最容易遇到 无答案,更快找出薄弱点。 排序方式: 测试正确 ↑.
31/31
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 无答案 次数 | 分类得分 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #118 | GLM 5.1 medium | Z.ai | 1 | 4.6 | $0.727 | 0/3 | 109.6s |
| #129 | Step 3.7 Flash high | Stepfun | 2 | 4.0 | $1.229 | 0/3 | 206.2s |
| #137 | Gemma 4 26B A4B medium | 2 | 2.9 | $0.092 | 0/3 | 272.5s | |
| #166 | Gemma 4 31B medium | 1 | 4.3 | $0.100 | 0/3 | 219.8s | |
| #189 | Step 3.5 Flash medium | Stepfun | 1 | 2.4 | $0.132 | 0/2 | 258.4s |
| #190 | Dots 3 Note Preview medium | Dots Studio | 1 | 4.2 | $0.000 | 0/3 | 309.1s |
| #191 | Mimo V2 Omni medium | Xiaomi | 1 | 3.3 | $0.683 | 0/3 | 183.9s |
| #252 | Trinity Large Thinking high | Arcee AI | 1 | 3.7 | $0.624 | 0/3 | 245.0s |
| #263 | MiniMax M2.5 medium | Minimax | 1 | 3.4 | $0.273 | 0/3 | 188.6s |
| #268 | GLM 4.7 Flash medium | Z.ai | 1 | 3.2 | $0.168 | 0/3 | 55.3s |
| #279 | Ling 3.0 Tiny high | Inclusionai | 2 | 2.9 | $0.000 | 0/3 | 177.7s |
| #280 | Ling 3.0 Tiny low | Inclusionai | 2 | 2.9 | $0.000 | 0/3 | 170.7s |
| #282 | Qwen3.5-9B medium | Qwen | 1 | 2.9 | $0.062 | 0/3 | 100.9s |
| #283 | Ling 3.0 Tiny medium | Inclusionai | 2 | 2.9 | $0.000 | 0/3 | 212.0s |
| #53 | DeepSeek V4 Flash 0731 low | DeepSeek | 1 | 7.3 | $0.072 | 1/3 | 163.3s |