Programación: Sin respuesta
Programación
Sin respuesta
Mira qué modelos de IA tienen más probabilidades de caer en Sin respuesta dentro de Programación, para detectar puntos débiles más rápido.
Motivos de fallo
31/31
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Cantidad de Sin respuesta | Puntuación de categoría | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #118 | GLM 5.1 medium | Z.ai | 1 | 4.6 | $0.727 | 0/3 | 109.6s |
| #123 | Kimi K2.5 medium | Moonshot AI | 1 | 6.1 | $0.479 | 1/3 | 217.5s |
| #150 | Qwen3.6 35B A3B medium | Qwen | 1 | 7.7 | $0.749 | 2/3 | 50.5s |
| #152 | Qwen3.6 27B medium | Qwen | 1 | 7.7 | $1.045 | 2/3 | 143.0s |
| #166 | Gemma 4 31B medium | 1 | 4.3 | $0.100 | 0/3 | 219.8s | |
| #170 | Qwen3.5-35B-A3B medium | Qwen | 1 | 5.9 | $1.140 | 1/3 | 206.6s |
| #189 | Step 3.5 Flash medium | Stepfun | 1 | 2.4 | $0.132 | 0/2 | 258.4s |
| #190 | Dots 3 Note Preview medium | Dots Studio | 1 | 4.2 | $0.000 | 0/3 | 309.1s |
| #191 | Mimo V2 Omni medium | Xiaomi | 1 | 3.3 | $0.683 | 0/3 | 183.9s |
| #219 | Laguna S 2.1 medium | Poolside | 1 | 5.3 | $0.053 | 1/3 | 159.0s |
| #225 | Laguna S 2.1 high | Poolside | 1 | 5.3 | $0.114 | 1/3 | 271.4s |
| #242 | MiniMax M2.7 medium | Minimax | 1 | 5.7 | $0.208 | 1/3 | 101.9s |
| #252 | Trinity Large Thinking high | Arcee AI | 1 | 3.7 | $0.624 | 0/3 | 245.0s |
| #263 | MiniMax M2.5 medium | Minimax | 1 | 3.4 | $0.273 | 0/3 | 188.6s |
| #268 | GLM 4.7 Flash medium | Z.ai | 1 | 3.2 | $0.168 | 0/3 | 55.3s |