编程:API 错误
编程
API 错误
看看哪些 AI 模型在 编程 上最容易遇到 API 错误,更快找出薄弱点。 排序方式: 响应时间(平均) ↓.
39/39
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | API 错误 次数 | 分类得分 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #200 | LongCat 2.0 low | Meituan | 1 | 0.7 | $0.630 | 1/3 | 479.3s |
| #235 | Trinity Large Thinking low | Arcee AI | 2 | 0.5 | $0.918 | 1/3 | 344.4s |
| #324 | Laguna S 2.1 high | Poolside | 1 | 0.5 | $0.145 | 1/3 | 271.4s |
| #292 | Hy4 preview low | Tencent | 1 | 0.5 | $1.844 | 0/3 | 219.1s |
| #202 | Step 3.7 Flash high | Stepfun | 1 | 0.4 | $1.478 | 0/3 | 206.2s |
| #330 | Mimo V2 Omni medium | Xiaomi | 1 | 0.3 | $0.683 | 0/3 | 183.9s |
| #147 | Qwen3.6 Plus medium | Qwen | 1 | 0.6 | $0.554 | 1/3 | 153.1s |
| #281 | Nemotron 3 Super medium | NVIDIA | 3 | 0.3 | $0.081 | 0/3 | 147.3s |
| #350 | Ring 2.6 1t default | Inclusionai | 2 | 0.5 | $0.026 | 1/3 | 143.8s |
| #192 | Ember-1 max | Fireworks | 2 | 0.5 | $3.264 | 1/3 | 105.1s |
| #317 | MiniMax M2.7 medium | Minimax | 1 | 0.6 | $0.326 | 1/3 | 101.9s |
| #331 | Hy3 preview high | Tencent | 2 | 0.5 | $0.135 | 1/3 | 99.8s |
| #307 | Mimo V2 PRO medium | Xiaomi | 1 | 0.6 | $0.333 | 1/3 | 94.2s |
| #382 | Command A+ medium | Cohere | 3 | 0.3 | $0.064 | 0/3 | 93.1s |
| #387 | Command A+ high | Cohere | 3 | 0.3 | $0.079 | 0/3 | 92.7s |