Programación: Formato extra
Programación
Formato extra
Mira qué modelos de IA tienen más probabilidades de caer en Formato extra dentro de Programación, para detectar puntos débiles más rápido. Ordenar por: Costo total ↓.
Motivos de fallo
33/33
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Cantidad de Formato extra | Puntuación de categoría | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #153 | Claude Opus 4.8 low | Anthropic | 1 | 0.7 | $3.787 | 1/3 | 7.58s |
| #243 | Claude Fable 5.1 low | Anthropic | 1 | 0.3 | $3.395 | 0/3 | 6.75s |
| #232 | Claude Opus 4.6 medium | Anthropic | 1 | 0.6 | $2.961 | 1/3 | 30.1s |
| #159 | Claude Opus 5 none | Anthropic | 1 | 0.6 | $2.766 | 1/3 | 5.54s |
| #216 | Claude Sonnet 4.6 medium | Anthropic | 1 | 0.6 | $2.126 | 1/3 | 33.3s |
| #128 | GLM 5.1 medium | Z.ai | 1 | 0.5 | $1.546 | 0/3 | 109.6s |
| #62 | Claude Sonnet 5.5 xhigh | Anthropic | 1 | 0.8 | $1.516 | 2/3 | 11.9s |
| #187 | Grok Build 0.1 medium | X AI | 1 | 0.6 | $1.419 | 1/3 | 108.5s |
| #204 | Claude Sonnet 5.5 medium | Anthropic | 1 | 0.3 | $1.100 | 0/3 | 6.07s |
| #211 | Grok 4.3 medium | X AI | 1 | 0.6 | $0.989 | 1/3 | 41.2s |
| #177 | Claude Sonnet 5.5 low | Anthropic | 1 | 0.3 | $0.909 | 0/3 | 5.81s |
| #252 | Claude Sonnet 4.6 none | Anthropic | 1 | 0.5 | $0.661 | 1/3 | 5.19s |
| #57 | MiMo-V2.6-Pro medium | Xiaomi | 1 | 0.8 | $0.586 | 2/3 | 150.4s |
| #191 | MiniMax M3 medium | Minimax | 1 | 0.6 | $0.422 | 1/3 | 144.7s |
| #220 | MiMo-V2.5-Pro medium | Xiaomi | 1 | 0.6 | $0.332 | 1/3 | 92.1s |