Truques anti-IA: Resposta incorreta
Truques anti-IA
Resposta incorreta
Veja quais modelos de IA têm mais chance de encontrar Resposta incorreta em Truques anti-IA, para identificar pontos fracos mais rápido.
Motivos de falha
144/144
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Contagem de Resposta incorreta | Pontuação da categoria | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #66 | KAT-Coder-Pro V2.5 low | Kwaipilot | 2 | 6.9 | $0.387 | 2/4 | 4.20s |
| #73 | KAT-Coder-Pro V2.5 high | Kwaipilot | 2 | 7.0 | $0.482 | 2/4 | 3.17s |
| #75 | Qwen3.7 Plus none | Qwen | 2 | 6.5 | $0.106 | 2/4 | 1.38s |
| #86 | DeepSeek V4 Pro none | DeepSeek | 2 | 3.2 | $0.096 | 0/4 | 4.02s |
| #91 | GPT-5.5 none | OpenAI | 2 | 6.9 | $0.544 | 2/4 | 1.31s |
| #92 | Gemini 3.5 Flash minimal | 2 | 6.5 | $0.300 | 2/4 | 892ms | |
| #108 | Laguna XS 2.1 medium | Poolside | 2 | 4.8 | $0.068 | 1/4 | 42.0s |
| #111 | Gemini 3.1 Flash Lite low | 2 | 7.3 | $0.621 | 2/4 | 1.84s | |
| #121 | Gemma 4 31B none | 2 | 6.5 | $0.021 | 2/4 | 1.85s | |
| #128 | Gemini 3.1 Flash Lite none | 2 | 7.5 | $0.046 | 2/4 | 1.07s | |
| #134 | GPT-5 Nano medium | OpenAI | 2 | 6.5 | $0.114 | 2/4 | 25.5s |
| #165 | KAT-Coder-Air V2.5 low | Kwaipilot | 2 | 7.3 | $0.041 | 2/4 | 3.50s |
| #168 | Laguna XS 2.1 none | Poolside | 2 | 5.3 | $0.008 | 1/4 | 755ms |
| #174 | Qwen3 Coder Next none | Qwen | 2 | 3.6 | $0.025 | 0/4 | 3.31s |
| #179 | North Mini Code none | Cohere | 2 | 3.0 | $0.000 | 0/4 | 22.5s |