编程:无答案
编程
无答案
看看哪些 AI 模型在 编程 上最容易遇到 无答案,更快找出薄弱点。 排序方式: 响应时间(平均) ↓.
31/31
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | 无答案 次数 | 分类得分 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #43 | Seed 2.1 Turbo medium | Bytedance Seed | 1 | 8.2 | $1.951 | 2/3 | 354.9s |
| #190 | Dots 3 Note Preview medium | Dots Studio | 1 | 4.2 | $0.000 | 0/3 | 309.1s |
| #158 | Dots 3 Note Preview high | Dots Studio | 2 | 5.8 | $0.000 | 1/3 | 306.2s |
| #157 | Dots 3 Note Preview low | Dots Studio | 2 | 5.9 | $0.000 | 1/3 | 287.6s |
| #137 | Gemma 4 26B A4B medium | 2 | 2.9 | $0.092 | 0/3 | 272.5s | |
| #225 | Laguna S 2.1 high | Poolside | 1 | 5.3 | $0.114 | 1/3 | 271.4s |
| #189 | Step 3.5 Flash medium | Stepfun | 1 | 2.4 | $0.132 | 0/2 | 258.4s |
| #252 | Trinity Large Thinking high | Arcee AI | 1 | 3.7 | $0.624 | 0/3 | 245.0s |
| #166 | Gemma 4 31B medium | 1 | 4.3 | $0.100 | 0/3 | 219.8s | |
| #123 | Kimi K2.5 medium | Moonshot AI | 1 | 6.1 | $0.479 | 1/3 | 217.5s |
| #105 | Kimi K2.6 medium | Moonshot AI | 1 | 5.7 | $1.235 | 1/3 | 214.4s |
| #283 | Ling 3.0 Tiny medium | Inclusionai | 2 | 2.9 | $0.000 | 0/3 | 212.0s |
| #170 | Qwen3.5-35B-A3B medium | Qwen | 1 | 5.9 | $1.140 | 1/3 | 206.6s |
| #129 | Step 3.7 Flash high | Stepfun | 2 | 4.0 | $1.229 | 0/3 | 206.2s |
| #103 | DeepSeek V4 Flash 0731 medium | DeepSeek | 2 | 6.4 | $0.106 | 1/3 | 198.8s |