Ranking de falhas por Erro de API

Veja quais modelos de IA encontram Erro de API com mais frequência para identificar riscos de confiabilidade antes de escolher.

Modelos exibidos

Falhas totais

161

Modelo mais afetado

Qwen3.6 Plus Preview 8

Categorias

Na categoria Programação45 Na categoria Combinado26 Na categoria Chamada de ferramentas17 Na categoria Análise e extração de dados14 Na categoria Truques anti-IA14 Na categoria Conhecimentos gerais13 Na categoria Inteligência geral12 Na categoria Resolução de quebra-cabeças12 Na categoria Específico do domínio7 Na categoria Seguimento de instruções1

68/68

Posição	Modelo	Empresa	Contagem de Erro de API	Pontuação	Custo total	Testes corretos	Tempo de resposta (médio)
#158	KAT-Coder-Air V2.5 low	Kwaipilot	2	5.4	$0.041	7/22	10.1s
Total de testes 22 Testes errados 15 Custo total $0.041 Tempo de resposta (médio) 10.1s
#161	Qwen3.6 35B A3B none	Qwen	2	5.3	$0.061	4/22	5.52s
Total de testes 22 Testes errados 18 Custo total $0.061 Tempo de resposta (médio) 5.52s
#167	Mistral Small 4 medium	Mistral	2	5.1	$0.096	5/22	10.8s
Total de testes 22 Testes errados 17 Custo total $0.096 Tempo de resposta (médio) 10.8s
#178	Ling-2.6-flash none	Inclusionai	2	4.9	$0.002	6/22	10.7s
Total de testes 22 Testes errados 16 Custo total $0.002 Tempo de resposta (médio) 10.7s
#181	Grok 4.20 Multi Agent Beta medium	X AI	2	4.8	$5.599	8/18	9.69s
Total de testes 18 Testes errados 10 Custo total $5.599 Tempo de resposta (médio) 9.69s
#183	Trinity Large Preview none	Arcee AI	2	4.8	$0.008	4/21	2.98s
Total de testes 21 Testes errados 17 Custo total $0.008 Tempo de resposta (médio) 2.98s
#27	Muse Spark 1.1 high	Meta	1	8.1	$1.694	12/22	31.5s
Total de testes 22 Testes errados 10 Custo total $1.694 Tempo de resposta (médio) 31.5s
#32	Inkling medium	Thinkingmachines	1	8.0	$0.391	15/22	16.2s
Total de testes 22 Testes errados 7 Custo total $0.391 Tempo de resposta (médio) 16.2s
#37	Qwen3.6 Plus medium	Qwen	1	7.8	$0.405	15/22	43.1s
Total de testes 22 Testes errados 7 Custo total $0.405 Tempo de resposta (médio) 43.1s
#46	DeepSeek V4 Pro high	DeepSeek	1	7.7	$0.200	10/22	79.1s
Total de testes 22 Testes errados 12 Custo total $0.200 Tempo de resposta (médio) 79.1s
#51	Nemotron 3 Ultra medium	NVIDIA	1	7.5	$0.774	13/22	32.2s
Total de testes 22 Testes errados 9 Custo total $0.774 Tempo de resposta (médio) 32.2s
#52	Kimi K2.7 Code medium	Moonshot AI	1	7.5	$0.751	12/22	84.2s
Total de testes 22 Testes errados 10 Custo total $0.751 Tempo de resposta (médio) 84.2s
#57	Qwen3.5 Plus 2026-02-15 medium	Qwen	1	7.5	$0.437	14/22	89.2s
Total de testes 22 Testes errados 8 Custo total $0.437 Tempo de resposta (médio) 89.2s
#60	LongCat 2.0 medium	Meituan	1	7.4	$0.478	12/22	136.6s
Total de testes 22 Testes errados 10 Custo total $0.478 Tempo de resposta (médio) 136.6s
#62	KAT-Coder-Pro V2.5 low	Kwaipilot	1	7.4	$0.387	11/22	19.5s
Total de testes 22 Testes errados 11 Custo total $0.387 Tempo de resposta (médio) 19.5s

←

1 2 3 4 5

→

Falhas por Erro de API

Filtrar modelos

Melhores modelos por Contagem de Erro de API

Contagem de Erro de API vs Pontuação

Melhores modelos por Tempo de resposta (médio)