Falhas por Sem resposta
Veja quais modelos de IA encontram Sem resposta com mais frequência para identificar riscos de confiabilidade antes de escolher. Ordenar por: Pontuação ↑.
Categorias
Na categoria Combinado29 Na categoria Programação18 Na categoria Conhecimentos gerais13 Na categoria Análise e extração de dados8 Na categoria Específico do domínio8 Na categoria Truques anti-IA4 Na categoria Resolução de quebra-cabeças3 Na categoria Chamada de ferramentas2 Na categoria Seguimento de instruções2
67/67
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Contagem de Sem resposta | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #155 | Kimi K2.5 none | Moonshot AI | 1 | 5.5 | $0.127 | 6/22 | 19.2s |
| #154 | MiMo-V2.5-Pro none | Xiaomi | 1 | 5.5 | $0.068 | 6/22 | 4.12s |
| #151 | GLM 5.1 none | Z.ai | 1 | 5.5 | $0.164 | 7/22 | 6.70s |
| #143 | Gemini 3.1 Flash Lite high | 1 | 5.6 | $2.044 | 10/18 | 62.0s | |
| #140 | Nemotron 3 Super medium | NVIDIA | 1 | 5.7 | $0.050 | 8/22 | 52.0s |
| #138 | Kimi K2.6 none | Moonshot AI | 1 | 5.8 | $0.184 | 7/22 | 19.6s |
| #134 | Mimo V2 Omni medium | Xiaomi | 2 | 5.9 | $0.683 | 10/21 | 41.2s |
| #132 | GPT-5.6 Terra none | OpenAI | 1 | 6.0 | $0.349 | 8/22 | 1.65s |
| #130 | Step 3.5 Flash medium | Stepfun | 1 | 6.0 | $0.108 | 11/21 | 174.2s |
| #128 | GPT-5 Nano medium | OpenAI | 1 | 6.1 | $0.114 | 9/22 | 54.9s |
| #122 | Gemini 3.1 Flash Lite none | 1 | 6.1 | $0.046 | 9/22 | 1.75s | |
| #120 | Gemini 3.1 Flash Lite minimal | 1 | 6.1 | $0.047 | 10/22 | 1.86s | |
| #119 | Qwen3.5-35B-A3B medium | Qwen | 2 | 6.2 | $0.837 | 11/22 | 112.5s |
| #116 | Seed-2.0-Lite none | Bytedance Seed | 1 | 6.2 | $0.066 | 8/22 | 4.40s |
| #112 | Claude Sonnet 5 none | Anthropic | 2 | 6.3 | $0.548 | 8/22 | 6.04s |