Programação: Sem resposta
Programação
Sem resposta
Veja quais modelos de IA têm mais chance de encontrar Sem resposta em Programação, para identificar pontos fracos mais rápido. Ordenar por: Custo total ↓.
Motivos de falha
31/31
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Contagem de Sem resposta | Pontuação da categoria | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #48 | Qwen3.8 2.4T A95B low | Qwen | 1 | 7.8 | $2.672 | 2/3 | 172.5s |
| #95 | Qwen3.8 2.4T A95B high | Qwen | 1 | 5.9 | $2.357 | 1/3 | 160.5s |
| #43 | Seed 2.1 Turbo medium | Bytedance Seed | 1 | 8.2 | $1.951 | 2/3 | 354.9s |
| #105 | Kimi K2.6 medium | Moonshot AI | 1 | 5.7 | $1.235 | 1/3 | 214.4s |
| #129 | Step 3.7 Flash high | Stepfun | 2 | 4.0 | $1.229 | 0/3 | 206.2s |
| #170 | Qwen3.5-35B-A3B medium | Qwen | 1 | 5.9 | $1.140 | 1/3 | 206.6s |
| #152 | Qwen3.6 27B medium | Qwen | 1 | 7.7 | $1.045 | 2/3 | 143.0s |
| #150 | Qwen3.6 35B A3B medium | Qwen | 1 | 7.7 | $0.749 | 2/3 | 50.5s |
| #118 | GLM 5.1 medium | Z.ai | 1 | 4.6 | $0.727 | 0/3 | 109.6s |
| #191 | Mimo V2 Omni medium | Xiaomi | 1 | 3.3 | $0.683 | 0/3 | 183.9s |
| #252 | Trinity Large Thinking high | Arcee AI | 1 | 3.7 | $0.624 | 0/3 | 245.0s |
| #123 | Kimi K2.5 medium | Moonshot AI | 1 | 6.1 | $0.479 | 1/3 | 217.5s |
| #77 | GLM 5 Turbo medium | Z.ai | 1 | 8.2 | $0.323 | 2/3 | 45.9s |
| #263 | MiniMax M2.5 medium | Minimax | 1 | 3.4 | $0.273 | 0/3 | 188.6s |
| #242 | MiniMax M2.7 medium | Minimax | 1 | 5.7 | $0.208 | 1/3 | 101.9s |