AI BENCHY 分类失败
编程:API 错误
编程
API 错误
看看哪些 AI 模型在 编程 上最容易遇到 API 错误,更快找出薄弱点。
29/29
筛选模型
没有模型匹配当前搜索和筛选条件。
| 排名 | 模型 | 公司 | API 错误 次数 | 分类得分 | 总成本 | 测试正确 | 响应时间(平均) |
|---|---|---|---|---|---|---|---|
| #105 | Nemotron 3 Super medium | NVIDIA | 3 | 3.1 | $0.020 | 0/3 | 147.3s |
| #111 | Gemini 3 PRO Preview medium | 3 | 3.0 | $0.385 | 0/3 | 0ms | |
| #70 | Hy3 preview medium | Tencent | 2 | 5.3 | $0.018 | 1/3 | 31.4s |
| #90 | Ring-2.6-1T medium | Inclusionai | 2 | 5.3 | $0.033 | 1/3 | 59.6s |
| #92 | Hy3 preview high | Tencent | 2 | 5.3 | $0.048 | 1/3 | 99.8s |
| #104 | Hy3 preview low | Tencent | 2 | 5.3 | $0.015 | 1/3 | 27.9s |
| #164 | Trinity Large Preview none | Arcee AI | 2 | 3.7 | $0.008 | 0/3 | 14.3s |
| #171 | Ling-2.6-flash none | Inclusionai | 2 | 5.3 | $0.001 | 1/3 | 11.2s |
| #172 | Ring-2.6-1T none | Inclusionai | 2 | 5.3 | $0.026 | 1/3 | 143.8s |
| #175 | Ling-2.6-1T none | Inclusionai | 2 | 3.8 | $0.005 | 0/3 | 10.6s |
| #180 | Elephant Alpha none | Openrouter | 2 | 4.2 | $0.000 | 0/3 | 1.39s |
| #181 | Elephant Alpha medium | Openrouter | 2 | 3.7 | $0.000 | 0/3 | 1.30s |
| #186 | Hy3 preview none | Tencent | 2 | 2.7 | $0.003 | 0/3 | 4.56s |
| #34 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 1 | 6.6 | $0.310 | 1/3 | 180.7s |
| #38 | Qwen3.6 Plus medium | Qwen | 1 | 6.1 | $0.294 | 1/3 | 153.1s |