Programación: Formato extra
Programación
Formato extra
Mira qué modelos de IA tienen más probabilidades de caer en Formato extra dentro de Programación, para detectar puntos débiles más rápido. Ordenar por: Tiempo de respuesta (promedio) ↑.
Motivos de fallo
33/33
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Cantidad de Formato extra | Puntuación de categoría | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #371 | Granite 4.1 8b default | IBM Granite | 1 | 0.4 | $0.007 | 0/3 | 775ms |
| #351 | Mimo V2 Omni default | Xiaomi | 1 | 0.4 | $0.021 | 0/3 | 2.75s |
| #254 | MiMo-V2.6-Pro none | Xiaomi | 2 | 0.6 | $0.193 | 1/3 | 3.69s |
| #252 | Claude Sonnet 4.6 none | Anthropic | 1 | 0.5 | $0.661 | 1/3 | 5.19s |
| #159 | Claude Opus 5 none | Anthropic | 1 | 0.6 | $2.766 | 1/3 | 5.54s |
| #177 | Claude Sonnet 5.5 low | Anthropic | 1 | 0.3 | $0.909 | 0/3 | 5.81s |
| #204 | Claude Sonnet 5.5 medium | Anthropic | 1 | 0.3 | $1.100 | 0/3 | 6.07s |
| #318 | Dots 3 Note Preview default | Dots Studio | 1 | 0.5 | $0.000 | 0/3 | 6.12s |
| #243 | Claude Fable 5.1 low | Anthropic | 1 | 0.3 | $3.395 | 0/3 | 6.75s |
| #153 | Claude Opus 4.8 low | Anthropic | 1 | 0.7 | $3.787 | 1/3 | 7.58s |
| #320 | KAT Coder AIR V2.5 low | Kwaipilot | 2 | 0.3 | $0.046 | 0/3 | 11.1s |
| #62 | Claude Sonnet 5.5 xhigh | Anthropic | 1 | 0.8 | $1.516 | 2/3 | 11.9s |
| #353 | KAT Coder AIR V2.5 default | Kwaipilot | 2 | 0.3 | $0.070 | 0/3 | 14.3s |
| #109 | MiMo-V2.6-Flash medium | Xiaomi | 1 | 0.7 | $0.218 | 1/3 | 18.2s |
| #312 | KAT Coder AIR V2.5 medium | Kwaipilot | 1 | 0.4 | $0.048 | 0/3 | 23.4s |