编程:API 错误
编程
API 错误
看看哪些 AI 模型在 编程 上最容易遇到 API 错误,更快找出薄弱点。 排序方式: 响应时间(平均) ↓.
35/35
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | API 错误 次数 | 分类得分 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #140 | LongCat 2.0 low | Meituan | 1 | 6.6 | $0.412 | 1/3 | 479.3s |
| #181 | Trinity Large Thinking low | Arcee AI | 2 | 5.3 | $0.658 | 1/3 | 344.4s |
| #225 | Laguna S 2.1 high | Poolside | 1 | 5.3 | $0.114 | 1/3 | 271.4s |
| #126 | Seed-2.0-Code high | Bytedance Seed | 1 | 6.2 | $1.273 | 1/3 | 266.7s |
| #54 | DeepSeek V4 Flash 0731 high | DeepSeek | 1 | 6.3 | $0.134 | 1/3 | 252.7s |
| #75 | DeepSeek V4 Pro high | DeepSeek | 1 | 6.3 | $0.761 | 1/3 | 243.0s |
| #191 | Mimo V2 Omni medium | Xiaomi | 1 | 3.3 | $0.683 | 0/3 | 183.9s |
| #86 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 1 | 6.6 | $0.459 | 1/3 | 180.7s |
| #63 | Qwen3.6 Plus medium | Qwen | 1 | 6.1 | $0.418 | 1/3 | 153.1s |
| #198 | Nemotron 3 Super medium | NVIDIA | 3 | 3.1 | $0.050 | 0/3 | 147.3s |
| #249 | Ring-2.6-1T none | Inclusionai | 2 | 5.3 | $0.026 | 1/3 | 143.8s |
| #73 | Seed-2.0-Code low | Bytedance Seed | 1 | 7.0 | $0.767 | 1/3 | 109.7s |
| #242 | MiniMax M2.7 medium | Minimax | 1 | 5.7 | $0.208 | 1/3 | 101.9s |
| #192 | Hy3 preview high | Tencent | 2 | 5.3 | $0.135 | 1/3 | 99.8s |
| #163 | Mimo V2 PRO medium | Xiaomi | 1 | 6.0 | $0.333 | 1/3 | 94.2s |