Programación: Sin respuesta
Programación
Sin respuesta
Mira qué modelos de IA tienen más probabilidades de caer en Sin respuesta dentro de Programación, para detectar puntos débiles más rápido. Ordenar por: Pruebas correctas ↓.
Motivos de fallo
31/31
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Cantidad de Sin respuesta | Puntuación de categoría | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #43 | Seed 2.1 Turbo medium | Bytedance Seed | 1 | 8.2 | $1.951 | 2/3 | 354.9s |
| #48 | Qwen3.8 2.4T A95B low | Qwen | 1 | 7.8 | $2.672 | 2/3 | 172.5s |
| #61 | Qwen3.8 27B low | Qwen | 1 | 7.7 | ~$0.071 | 2/3 | 140.9s |
| #77 | GLM 5 Turbo medium | Z.ai | 1 | 8.2 | $0.323 | 2/3 | 45.9s |
| #150 | Qwen3.6 35B A3B medium | Qwen | 1 | 7.7 | $0.749 | 2/3 | 50.5s |
| #152 | Qwen3.6 27B medium | Qwen | 1 | 7.7 | $1.045 | 2/3 | 143.0s |
| #53 | DeepSeek V4 Flash 0731 low | DeepSeek | 1 | 7.3 | $0.072 | 1/3 | 163.3s |
| #95 | Qwen3.8 2.4T A95B high | Qwen | 1 | 5.9 | $2.357 | 1/3 | 160.5s |
| #103 | DeepSeek V4 Flash 0731 medium | DeepSeek | 2 | 6.4 | $0.106 | 1/3 | 198.8s |
| #105 | Kimi K2.6 medium | Moonshot AI | 1 | 5.7 | $1.235 | 1/3 | 214.4s |
| #123 | Kimi K2.5 medium | Moonshot AI | 1 | 6.1 | $0.479 | 1/3 | 217.5s |
| #157 | Dots 3 Note Preview low | Dots Studio | 2 | 5.9 | $0.000 | 1/3 | 287.6s |
| #158 | Dots 3 Note Preview high | Dots Studio | 2 | 5.8 | $0.000 | 1/3 | 306.2s |
| #170 | Qwen3.5-35B-A3B medium | Qwen | 1 | 5.9 | $1.140 | 1/3 | 206.6s |
| #219 | Laguna S 2.1 medium | Poolside | 1 | 5.3 | $0.053 | 1/3 | 159.0s |