Falhas por Sem resposta
Veja quais modelos de IA encontram Sem resposta com mais frequência para identificar riscos de confiabilidade antes de escolher. Ordenar por: Testes corretos ↑.
Categorias
Na categoria Combinado43 Na categoria Programação39 Na categoria Específico do domínio35 Na categoria Conhecimentos gerais27 Na categoria Truques anti-IA13 Na categoria Resolução de quebra-cabeças11 Na categoria Análise e extração de dados9 Na categoria Chamada de ferramentas2 Na categoria Seguimento de instruções2
119/119
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Contagem de Sem resposta | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #285 | Laguna S 2.1 none | Poolside | 1 | 4.5 | $0.022 | 2/22 | 11.7s |
| #228 | Hy4 preview low | Tencent | 1 | 5.6 | $1.745 | 3/22 | 214.3s |
| #283 | Qwen3 Coder Next medium | Qwen | 1 | 4.6 | $0.034 | 3/22 | 9.07s |
| #304 | Qwen3.5-9B medium | Qwen | 3 | 3.8 | $0.062 | 3/22 | 107.5s |
| #234 | Laguna S 2.1 medium | Poolside | 2 | 5.4 | $0.053 | 4/22 | 58.4s |
| #240 | Laguna S 2.1 high | Poolside | 2 | 5.4 | $0.114 | 4/22 | 111.6s |
| #246 | Qwen3.6 35B A3B none | Qwen | 1 | 5.3 | $0.051 | 4/22 | 5.57s |
| #271 | GPT-5.4 Nano none | OpenAI | 1 | 4.8 | $0.041 | 4/22 | 2.56s |
| #282 | Granite 4.2 8B high | IBM Granite | 1 | 4.6 | $0.084 | 4/22 | 235.9s |
| #289 | GLM 4.7 Flash medium | Z.ai | 3 | 4.3 | $0.168 | 4/22 | 134.3s |
| #301 | Ling 3.0 Tiny high | Inclusionai | 7 | 3.8 | $0.000 | 4/22 | 75.7s |
| #302 | Ling 3.0 Tiny low | Inclusionai | 7 | 3.8 | $0.000 | 4/22 | 66.2s |
| #305 | Ling 3.0 Tiny medium | Inclusionai | 7 | 3.8 | $0.000 | 4/22 | 68.1s |
| #308 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 1 | 3.4 | $0.000 | 4/19 | 17.1s |
| #237 | MiMo-V2.5-Pro none | Xiaomi | 1 | 5.4 | $0.068 | 5/22 | 4.24s |