Fallos por categoría de AI BENCHY
Resolución de acertijos: Formato extra
Resolución de acertijos
Formato extra
Mira qué modelos de IA tienen más probabilidades de caer en Formato extra dentro de Resolución de acertijos, para detectar puntos débiles más rápido. Ordenar por: Pruebas correctas ↓.
Motivos de fallo
| Rango | Modelo | Empresa | Cantidad de Formato extra | Puntuación de categoría | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|
| #42 | Claude Sonnet 4.6 none | Anthropic | 1 | 7.7 | 2/3 | 2.92s |
| #23 | MiMo-V2-Pro medium | Xiaomi | 1 | 7.0 | 1/3 | 4.71s |