Programação: Resposta incorreta
Programação
Resposta incorreta
Veja quais modelos de IA têm mais chance de encontrar Resposta incorreta em Programação, para identificar pontos fracos mais rápido.
Motivos de falha
265/265
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Contagem de Resposta incorreta | Pontuação da categoria | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #285 | GPT-6 Luna none | OpenAI | 2 | 0.5 | $0.026 | 1/3 | 8.04s |
| #286 | Gemma 4 26B A4B none | 2 | 0.4 | $0.031 | 0/3 | 4.16s | |
| #287 | GLM 5V Turbo medium | Z.ai | 2 | 0.6 | $0.457 | 1/3 | 63.4s |
| #290 | Qwen3.8 27B none | Qwen | 2 | 0.5 | ~$0.010 | 1/3 | 1.19s |
| #292 | Hy4 preview low | Tencent | 2 | 0.5 | $1.844 | 0/3 | 219.1s |
| #293 | MiMo-V2.6-Flash none | Xiaomi | 2 | 0.4 | $0.060 | 0/3 | 744ms |
| #295 | Ember-1 none | Fireworks | 2 | 0.5 | $0.786 | 1/3 | 1.94s |
| #298 | Granite 4.2 8B low | IBM Granite | 2 | 0.5 | $0.036 | 1/3 | 13.0s |
| #299 | Kimi K2.5 none | Moonshot AI | 2 | 0.5 | $0.262 | 1/3 | 24.6s |
| #302 | Qwen3.6 35B A3B none | Qwen | 2 | 0.5 | $0.105 | 1/3 | 8.77s |
| #304 | Ling 3.0 Flash none | Inclusionai | 2 | 0.5 | $0.004 | 1/3 | 6.39s |
| #305 | Nemotron 3.5 Lightning high | NVIDIA | 2 | 0.4 | $0.168 | 0/3 | 168.4s |
| #311 | Mercury 2.5 low | Inception | 2 | 0.5 | $0.020 | 1/3 | 972ms |
| #312 | KAT Coder AIR V2.5 medium | Kwaipilot | 2 | 0.4 | $0.048 | 0/3 | 23.4s |
| #313 | MiMo-V2.5-Pro none | Xiaomi | 2 | 0.4 | $0.135 | 0/3 | 1.41s |