Timed out Failures
See which AI models run into Timed out most often, so you can spot reliability risks before choosing one. Sort by: Response Time (avg) ↓.
44/44
Filter models
No models match the current search and filters.
| Rank | Model | Company | Timed out Count | Score | Total Cost | Tests Correct | Response Time (avg) |
|---|---|---|---|---|---|---|---|
| #46 | GLM 5 medium | Z.ai | 1 | 7.7 | $0.307 | 15/21 | 33.5s |
| #29 | GPT-5 Mini medium | OpenAI | 1 | 8.1 | $0.237 | 12/22 | 27.6s |
| #44 | Claude Sonnet 4.6 medium | Anthropic | 1 | 7.8 | $2.057 | 14/22 | 25.9s |
| #194 | Grok 4.1 Fast medium | X AI | 1 | 4.7 | $0.069 | 9/19 | 23.8s |
| #42 | GLM 5.2 medium | Z.ai | 1 | 7.8 | $0.182 | 15/21 | 23.3s |
| #53 | GLM 5 Turbo medium | Z.ai | 1 | 7.6 | $0.323 | 14/21 | 23.0s |
| #24 | GPT-5.2 medium | OpenAI | 1 | 8.4 | $0.951 | 14/22 | 22.6s |
| #115 | Mimo V2 PRO medium | Xiaomi | 1 | 6.3 | $0.333 | 12/21 | 22.2s |
| #119 | MiMo-V2-Flash medium | Xiaomi | 1 | 6.3 | $0.043 | 12/21 | 20.1s |
| #193 | Hunter Alpha medium | OpenRouter | 2 | 4.7 | $0.000 | 8/18 | 10.3s |
| #196 | Qwen3 Coder Next medium | Qwen | 1 | 4.7 | $0.032 | 4/22 | 9.61s |
| #162 | Gemma 4 26B A4B none | 1 | 5.5 | $0.015 | 8/22 | 7.64s | |
| #18 | Claude Opus 4.7 medium | Anthropic | 1 | 8.7 | $1.477 | 18/22 | 7.61s |
| #168 | Laguna XS 2.1 none | Poolside | 1 | 5.3 | $0.008 | 5/22 | 1.55s |