综合:API 错误
综合
API 错误
看看哪些 AI 模型在 综合 上最容易遇到 API 错误,更快找出薄弱点。 排序方式: 测试正确 ↓.
33/33
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | API 错误 次数 | 分类得分 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #66 | Kimi K3 max | Moonshot AI | 1 | 6.5 | $3.467 | 1/2 | 223.0s |
| #81 | Seed-2.0-Code low | Bytedance Seed | 1 | 7.3 | $0.767 | 1/2 | 99.1s |
| #104 | LongCat 2.0 medium | Meituan | 1 | 7.3 | $0.499 | 1/2 | 151.0s |
| #110 | KAT-Coder-Pro V2.5 low | Kwaipilot | 1 | 6.4 | $0.400 | 1/2 | 111.9s |
| #120 | Qwen3.7 Flash low | Qwen | 1 | 6.4 | $0.043 | 1/2 | 217.8s |
| #125 | Solar Pro 4 high | Upstage | 1 | 7.3 | $0.046 | 1/2 | 167.4s |
| #135 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 1 | 6.4 | $0.478 | 1/2 | 135.7s |
| #138 | Seed-2.0-Code high | Bytedance Seed | 1 | 7.3 | $1.273 | 1/2 | 144.9s |
| #143 | Solar Pro 4 low | Upstage | 1 | 6.3 | $0.044 | 1/2 | 358.1s |
| #144 | Solar Pro 4 medium | Upstage | 1 | 6.4 | $0.047 | 1/2 | 294.8s |
| #202 | Step 3.5 Flash medium | Stepfun | 1 | 6.5 | $0.132 | 1/2 | 813.7s |
| #212 | Nemotron 3 Super medium | NVIDIA | 1 | 6.4 | $0.050 | 1/2 | 259.9s |
| #220 | KAT-Coder-Air V2.5 high | Kwaipilot | 1 | 6.5 | $0.077 | 1/2 | 74.5s |
| #226 | KAT-Coder-Air V2.5 medium | Kwaipilot | 1 | 6.5 | $0.048 | 1/2 | 19.6s |
| #235 | KAT-Coder-Air V2.5 low | Kwaipilot | 1 | 6.4 | $0.046 | 1/2 | 55.9s |