编程:无答案
编程
无答案
看看哪些 AI 模型在 编程 上最容易遇到 无答案,更快找出薄弱点。 排序方式: 响应时间(平均) ↑.
31/31
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 无答案 次数 | 分类得分 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #77 | GLM 5 Turbo medium | Z.ai | 1 | 8.2 | $0.323 | 2/3 | 45.9s |
| #150 | Qwen3.6 35B A3B medium | Qwen | 1 | 7.7 | $0.749 | 2/3 | 50.5s |
| #268 | GLM 4.7 Flash medium | Z.ai | 1 | 3.2 | $0.168 | 0/3 | 55.3s |
| #282 | Qwen3.5-9B medium | Qwen | 1 | 2.9 | $0.062 | 0/3 | 100.9s |
| #242 | MiniMax M2.7 medium | Minimax | 1 | 5.7 | $0.208 | 1/3 | 101.9s |
| #118 | GLM 5.1 medium | Z.ai | 1 | 4.6 | $0.727 | 0/3 | 109.6s |
| #61 | Qwen3.8 27B low | Qwen | 1 | 7.7 | ~$0.071 | 2/3 | 140.9s |
| #152 | Qwen3.6 27B medium | Qwen | 1 | 7.7 | $1.045 | 2/3 | 143.0s |
| #219 | Laguna S 2.1 medium | Poolside | 1 | 5.3 | $0.053 | 1/3 | 159.0s |
| #95 | Qwen3.8 2.4T A95B high | Qwen | 1 | 5.9 | $2.357 | 1/3 | 160.5s |
| #53 | DeepSeek V4 Flash 0731 low | DeepSeek | 1 | 7.3 | $0.072 | 1/3 | 163.3s |
| #280 | Ling 3.0 Tiny low | Inclusionai | 2 | 2.9 | $0.000 | 0/3 | 170.7s |
| #48 | Qwen3.8 2.4T A95B low | Qwen | 1 | 7.8 | $2.672 | 2/3 | 172.5s |
| #279 | Ling 3.0 Tiny high | Inclusionai | 2 | 2.9 | $0.000 | 0/3 | 177.7s |
| #191 | Mimo V2 Omni medium | Xiaomi | 1 | 3.3 | $0.683 | 0/3 | 183.9s |