Timed out Failures
See which AI models run into Timed out most often, so you can spot reliability risks before choosing one. Sort by: Response Time (avg) ↓.
54/54
Filter models
No models match the current search and filters.
| Rank | Model | Company | Timed out Count | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #299 | Granite 4.2 8B high | IBM Granite | 10 | 4.6 | $0.135 | 4/22 | 235.9s |
| #217 | Step 3.5 Flash medium | Stepfun | 1 | 5.9 | $0.132 | 10/21 | 191.6s |
| #31 | Qwen3.8 Max (0902) high | Qwen | 1 | 8.9 | $2.736 | 17/22 | 185.6s |
| #170 | LongCat 2.0 high | Meituan | 2 | 6.7 | $0.492 | 9/22 | 153.3s |
| #117 | LongCat 2.0 medium | Meituan | 1 | 7.4 | $0.499 | 12/22 | 143.6s |
| #79 | Kimi K3 max | Moonshot AI | 1 | 7.9 | $2.528 | 16/22 | 142.8s |
| #226 | North Mini Code medium | Cohere | 1 | 5.7 | $0.000 | 8/22 | 142.0s |
| #157 | Solar Pro 4 low | Upstage | 1 | 6.8 | $0.130 | 11/22 | 136.1s |
| #306 | GLM 4.7 Flash medium | Z.ai | 2 | 4.3 | $0.168 | 4/22 | 134.3s |
| #129 | Kimi K2.6 medium | Moonshot AI | 3 | 7.2 | $1.247 | 12/22 | 115.9s |
| #167 | LongCat 2.0 low | Meituan | 1 | 6.7 | $0.412 | 10/22 | 113.6s |
| #108 | Qwen3.5-27B medium | Qwen | 1 | 7.5 | $0.982 | 13/22 | 113.3s |
| #198 | Qwen3.5-35B-A3B medium | Qwen | 4 | 6.1 | $1.172 | 11/22 | 110.8s |
| #322 | Qwen3.5-9B medium | Qwen | 11 | 3.8 | $0.062 | 3/22 | 107.5s |
| #164 | Gemma 4 26B A4B medium | 2 | 6.8 | $0.084 | 15/22 | 104.9s |