AI BENCHY
Advertise here

Fallos por categoría de AI BENCHY

Específico del dominio: No siguió las instrucciones

Específico del dominio
No siguió las instrucciones

Mira qué modelos de IA tienen más probabilidades de caer en No siguió las instrucciones dentro de Específico del dominio, para detectar puntos débiles más rápido. Ordenar por: Tiempo de respuesta (promedio) ↑.

Modelos mostrados

1

Fallos totales

1

Modelo más afectado

Grok Build 0.1 1

Mejores modelos por Cantidad de No siguió las instrucciones

Cantidad de No siguió las instrucciones vs Puntuación

Mejores modelos por Tiempo de respuesta (promedio)

Mejores modelos por Costo desperdiciado estimado