Ranking de falhas por Erro de API

Veja quais modelos de IA encontram Erro de API com mais frequência para identificar riscos de confiabilidade antes de escolher.

Modelos exibidos

Falhas totais

161

Modelo mais afetado

Qwen3.6 Plus Preview 8

Categorias

Na categoria Programação45 Na categoria Combinado26 Na categoria Chamada de ferramentas17 Na categoria Análise e extração de dados14 Na categoria Truques anti-IA14 Na categoria Conhecimentos gerais13 Na categoria Inteligência geral12 Na categoria Resolução de quebra-cabeças12 Na categoria Específico do domínio7 Na categoria Seguimento de instruções1

68/68

Posição	Modelo	Empresa	Contagem de Erro de API	Pontuação	Custo total	Testes corretos	Tempo de resposta (médio)
#209	Step 3.5 Flash none	Stepfun	4	2.3	$0.020	6/12	39.0s
Total de testes 12 Testes errados 6 Custo total $0.020 Tempo de resposta (médio) 39.0s
#210	LFM2-24B-A2B none	Liquid	4	2.2	$0.001	2/16	782ms
Total de testes 16 Testes errados 14 Custo total $0.001 Tempo de resposta (médio) 782ms
#100	Hy3 preview medium	Tencent	3	6.5	$0.018	14/21	16.3s
Total de testes 21 Testes errados 7 Custo total $0.018 Tempo de resposta (médio) 16.3s
#144	KAT-Coder-Air V2.5 high	Kwaipilot	3	5.6	$0.077	7/22	15.9s
Total de testes 22 Testes errados 15 Custo total $0.077 Tempo de resposta (médio) 15.9s
#162	Ling-2.6-1T none	Inclusionai	3	5.3	$0.016	4/22	8.58s
Total de testes 22 Testes errados 18 Custo total $0.016 Tempo de resposta (médio) 8.58s
#193	Elephant Alpha none	Openrouter	3	4.3	$0.000	5/21	1.22s
Total de testes 21 Testes errados 16 Custo total $0.000 Tempo de resposta (médio) 1.22s
#195	Elephant Alpha medium	Openrouter	3	4.3	$0.000	6/21	1.27s
Total de testes 21 Testes errados 15 Custo total $0.000 Tempo de resposta (médio) 1.27s
#202	Grok Build 0.1 none	X AI	3	4.0	$0.547	7/19	28.7s
Total de testes 19 Testes errados 12 Custo total $0.547 Tempo de resposta (médio) 28.7s
#206	gpt-oss-120b none	OpenAI	3	3.7	$0.010	6/19	21.6s
Total de testes 19 Testes errados 13 Custo total $0.010 Tempo de resposta (médio) 21.6s
#33	Kimi K3 max	Moonshot AI	2	8.0	$3.112	16/22	122.5s
Total de testes 22 Testes errados 6 Custo total $3.112 Tempo de resposta (médio) 122.5s
#76	DeepSeek V3.2 medium	DeepSeek	2	7.0	$0.078	11/22	68.6s
Total de testes 22 Testes errados 11 Custo total $0.078 Tempo de resposta (médio) 68.6s
#90	Qwen3.6 35B A3B medium	Qwen	2	6.7	$0.746	13/22	58.1s
Total de testes 22 Testes errados 9 Custo total $0.746 Tempo de resposta (médio) 58.1s
#108	Ring-2.6-1T medium	Inclusionai	2	6.3	$0.103	11/22	68.7s
Total de testes 22 Testes errados 11 Custo total $0.103 Tempo de resposta (médio) 68.7s
#110	Gemma 4 31B medium	Google	2	6.3	$0.163	14/22	75.4s
Total de testes 22 Testes errados 8 Custo total $0.163 Tempo de resposta (médio) 75.4s
#115	Gemma 4 31B none	Google	2	6.2	$0.035	10/22	5.34s
Total de testes 22 Testes errados 12 Custo total $0.035 Tempo de resposta (médio) 5.34s

←

1 2 3 4 5

→

Falhas por Erro de API

Filtrar modelos

Melhores modelos por Contagem de Erro de API

Contagem de Erro de API vs Pontuação

Melhores modelos por Tempo de resposta (médio)