Falhas por Erro de API
Veja quais modelos de IA encontram Erro de API com mais frequência para identificar riscos de confiabilidade antes de escolher.
Categorias
Na categoria Programação56 Na categoria Combinado37 Na categoria Chamada de ferramentas25 Na categoria Truques anti-IA20 Na categoria Análise e extração de dados17 Na categoria Específico do domínio17 Na categoria Resolução de quebra-cabeças15 Na categoria Conhecimentos gerais14 Na categoria Inteligência geral14 Na categoria Seguimento de instruções2
94/94
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Contagem de Erro de API | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #133 | DeepSeek V3.2 medium | DeepSeek | 2 | 7.0 | $0.078 | 11/22 | 68.4s |
| #157 | LongCat 2.0 low | Meituan | 2 | 6.7 | $0.412 | 10/22 | 113.6s |
| #167 | Qwen3.6 35B A3B medium | Qwen | 2 | 6.6 | $0.672 | 12/22 | 58.5s |
| #180 | Ring-2.6-1T medium | Inclusionai | 2 | 6.4 | $0.102 | 11/22 | 68.8s |
| #184 | Gemma 4 31B medium | 2 | 6.2 | $0.100 | 13/22 | 78.6s | |
| #196 | Gemma 4 31B none | 2 | 6.1 | $0.016 | 9/22 | 5.41s | |
| #198 | Nemotron 3 Ultra none | NVIDIA | 2 | 6.1 | $0.093 | 8/22 | 3.88s |
| #199 | Trinity Large Thinking low | Arcee AI | 2 | 6.0 | $0.625 | 8/22 | 96.6s |
| #240 | KAT-Coder-Air V2.5 low | Kwaipilot | 2 | 5.4 | $0.046 | 7/22 | 10.6s |
| #251 | Qwen3.6 35B A3B none | Qwen | 2 | 5.3 | $0.051 | 4/22 | 5.57s |
| #271 | Ling-2.6-flash none | Inclusionai | 2 | 4.9 | $0.002 | 6/22 | 10.7s |
| #278 | Grok 4.20 Multi Agent Beta medium | X AI | 2 | 4.8 | $5.599 | 8/18 | 9.69s |
| #281 | Trinity Large Preview none | Arcee AI | 2 | 4.8 | $0.008 | 4/21 | 2.98s |
| #59 | Muse Spark 1.3 low | Meta | 1 | 8.2 | $0.689 | 15/22 | 16.0s |
| #65 | Muse Spark 1.1 high | Meta | 1 | 8.0 | $2.253 | 12/22 | 36.9s |