Programación: Formato extra
Programación
Formato extra
Mira qué modelos de IA tienen más probabilidades de caer en Formato extra dentro de Programación, para detectar puntos débiles más rápido. Ordenar por: Pruebas correctas ↑.
Motivos de fallo
33/33
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Cantidad de Formato extra | Puntuación de categoría | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #128 | GLM 5.1 medium | Z.ai | 1 | 0.5 | $1.546 | 0/3 | 109.6s |
| #177 | Claude Sonnet 5.5 low | Anthropic | 1 | 0.3 | $0.909 | 0/3 | 5.81s |
| #204 | Claude Sonnet 5.5 medium | Anthropic | 1 | 0.3 | $1.100 | 0/3 | 6.07s |
| #243 | Claude Fable 5.1 low | Anthropic | 1 | 0.3 | $3.395 | 0/3 | 6.75s |
| #274 | Dots 3 Note Preview medium | Dots Studio | 1 | 0.4 | $0.000 | 0/3 | 309.1s |
| #283 | Ling 3.1 Flash none | Inclusionai | 1 | 0.5 | $0.000 | 0/3 | 31.9s |
| #305 | Nemotron 3.5 Lightning high | NVIDIA | 1 | 0.4 | $0.168 | 0/3 | 168.4s |
| #306 | KAT Coder AIR V2.5 high | Kwaipilot | 1 | 0.4 | $0.077 | 0/3 | 39.1s |
| #312 | KAT Coder AIR V2.5 medium | Kwaipilot | 1 | 0.4 | $0.048 | 0/3 | 23.4s |
| #318 | Dots 3 Note Preview default | Dots Studio | 1 | 0.5 | $0.000 | 0/3 | 6.12s |
| #320 | KAT Coder AIR V2.5 low | Kwaipilot | 2 | 0.3 | $0.046 | 0/3 | 11.1s |
| #351 | Mimo V2 Omni default | Xiaomi | 1 | 0.4 | $0.021 | 0/3 | 2.75s |
| #353 | KAT Coder AIR V2.5 default | Kwaipilot | 2 | 0.3 | $0.070 | 0/3 | 14.3s |
| #371 | Granite 4.1 8b default | IBM Granite | 1 | 0.4 | $0.007 | 0/3 | 775ms |
| #109 | MiMo-V2.6-Flash medium | Xiaomi | 1 | 0.7 | $0.218 | 1/3 | 18.2s |