Falhas por Tempo esgotado
Veja quais modelos de IA encontram Tempo esgotado com mais frequência para identificar riscos de confiabilidade antes de escolher. Ordenar por: Testes corretos ↑.
Categorias
Na categoria Específico do domínio44 Na categoria Programação29 Na categoria Resolução de quebra-cabeças11 Na categoria Combinado9 Na categoria Truques anti-IA6 Na categoria Seguimento de instruções5 Na categoria Inteligência geral4 Na categoria Análise e extração de dados2 Na categoria Conhecimentos gerais1
55/55
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Contagem de Tempo esgotado | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #250 | Gemma 4 26B A4B none | 1 | 5.6 | $0.017 | 9/22 | 7.58s | |
| #307 | Hunter Alpha medium | OpenRouter | 2 | 4.7 | $0.000 | 8/18 | 10.3s |
| #100 | DeepSeek V4 Pro high | DeepSeek | 1 | 7.7 | $0.424 | 10/22 | 92.5s |
| #156 | Kimi K2.5 medium | Moonshot AI | 2 | 7.0 | $0.479 | 10/22 | 98.2s |
| #176 | LongCat 2.0 low | Meituan | 1 | 6.7 | $0.412 | 10/22 | 113.6s |
| #308 | Grok 4.1 Fast medium | X AI | 1 | 4.7 | $0.069 | 9/19 | 23.8s |
| #229 | Step 3.5 Flash medium | Stepfun | 1 | 5.9 | $0.132 | 10/21 | 191.6s |
| #112 | MiniMax M3 medium | Minimax | 3 | 7.5 | $0.300 | 11/22 | 75.2s |
| #122 | Kimi K2.7 Code medium | Moonshot AI | 3 | 7.4 | $0.655 | 11/22 | 80.1s |
| #135 | DeepSeek V4 Flash 0731 medium | DeepSeek | 1 | 7.3 | $0.216 | 11/22 | 84.7s |
| #150 | DeepSeek V3.2 medium | DeepSeek | 2 | 7.0 | $0.078 | 11/22 | 68.4s |
| #155 | Seed-2.0-Mini medium | Bytedance Seed | 4 | 7.0 | $0.116 | 11/22 | 93.1s |
| #166 | Solar Pro 4 low | Upstage | 1 | 6.8 | $0.130 | 11/22 | 136.1s |
| #210 | Qwen3.5-35B-A3B medium | Qwen | 4 | 6.1 | $1.148 | 11/22 | 110.8s |
| #214 | Qwen3.5-Flash medium | Qwen | 3 | 6.1 | $0.142 | 11/22 | 84.4s |