Fallos por Sin respuesta
Mira qué modelos de IA se encuentran con Sin respuesta con más frecuencia para detectar riesgos de fiabilidad antes de elegir.
Categorías
En la categoría Combinado43 En la categoría Programación39 En la categoría Específico del dominio35 En la categoría Cultura general27 En la categoría Trucos anti-IA13 En la categoría Resolución de acertijos11 En la categoría Análisis y extracción de datos9 En la categoría Llamada de herramientas2 En la categoría Seguimiento de instrucciones2
119/119
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Cantidad de Sin respuesta | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #61 | Qwen3.8 2.4T A95B low | Qwen | 2 | 8.1 | $2.672 | 15/22 | 119.0s |
| #68 | GLM 5.2 high | Z.ai | 2 | 8.0 | $1.188 | 14/22 | 69.9s |
| #71 | Kimi K3 max | Moonshot AI | 2 | 7.9 | $3.467 | 16/22 | 142.8s |
| #74 | Qwen3.8 27B low | Qwen | 2 | 7.9 | ~$0.071 | 15/22 | 39.1s |
| #78 | GLM 5.2 medium | Z.ai | 2 | 7.8 | $0.224 | 15/21 | 23.3s |
| #92 | Solar Pro 4 xhigh | Upstage | 2 | 7.6 | $0.050 | 12/22 | 134.9s |
| #110 | Qwen3.8 2.4T A95B high | Qwen | 2 | 7.4 | $2.357 | 14/22 | 120.6s |
| #123 | Muse Glimmer 30B high | Meta | 2 | 7.2 | $0.397 | 10/22 | 66.7s |
| #134 | GLM 5.1 medium | Z.ai | 2 | 7.0 | $0.727 | 12/22 | 58.8s |
| #139 | Kimi K2.5 medium | Moonshot AI | 2 | 7.0 | $0.479 | 10/22 | 98.2s |
| #154 | Gemma 4 26B A4B medium | 2 | 6.8 | $0.092 | 15/22 | 104.9s | |
| #160 | LongCat 2.0 high | Meituan | 2 | 6.7 | $0.492 | 9/22 | 153.3s |
| #171 | Laguna XS 2.1 medium | Poolside | 2 | 6.5 | $0.068 | 9/22 | 48.2s |
| #175 | Dots 3 Note Preview low | Dots Studio | 2 | 6.4 | $0.000 | 10/22 | 61.8s |
| #176 | Dots 3 Note Preview high | Dots Studio | 2 | 6.4 | $0.000 | 10/22 | 67.8s |