AI BENCHY
Your ad here

Falhas por categoria AI BENCHY

Chamada de ferramentas: Resposta incorreta

Chamada de ferramentas
Resposta incorreta

Veja quais modelos de IA têm mais chance de encontrar Resposta incorreta em Chamada de ferramentas, para identificar pontos fracos mais rápido. Ordenar por: Contagem de falhas ↑.

Modelos exibidos

2

Falhas totais

2

Modelo mais afetado

GLM 4.7 Flash 1

Melhores modelos por Contagem de Resposta incorreta

Contagem de Resposta incorreta vs Pontuação

Melhores modelos por Tempo de resposta (médio)

Melhores modelos por Custo desperdiçado estimado