AI BENCHY
Comparar Gráficos Metodologia
❤️ Made by XCS
Your ad here

Falhas por categoria AI BENCHY

Chamada de ferramentas
Sem resposta

Veja quais modelos de IA têm mais chance de encontrar Sem resposta em Chamada de ferramentas, para identificar pontos fracos mais rápido. Ordenar por: Testes corretos ↓.

Modelos exibidos

2

Falhas totais

2

Modelo mais afetado

GPT-5.2 1

Motivos de falha relacionados

Melhores modelos por Contagem de Sem resposta

Contagem de Sem resposta vs pontuação média

Melhores modelos por Tempo de resposta (médio)

Melhores modelos por Custo desperdiçado estimado