Fallos por Sin respuesta
Mira qué modelos de IA se encuentran con Sin respuesta con más frecuencia para detectar riesgos de fiabilidad antes de elegir. Ordenar por: Tiempo de respuesta (promedio) ↓.
Categorías
En la categoría Combinado29 En la categoría Programación18 En la categoría Cultura general13 En la categoría Análisis y extracción de datos8 En la categoría Específico del dominio8 En la categoría Trucos anti-IA4 En la categoría Resolución de acertijos3 En la categoría Llamada de herramientas2 En la categoría Seguimiento de instrucciones2
67/67
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Cantidad de Sin respuesta | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #186 | Laguna M.1 medium | Poolside | 1 | 4.7 | $0.033 | 9/19 | 14.7s |
| #41 | Claude Opus 4.8 low | Anthropic | 1 | 7.8 | $2.077 | 16/22 | 12.7s |
| #14 | Claude Opus 4.8 medium | Anthropic | 1 | 8.8 | $1.931 | 18/22 | 12.5s |
| #167 | Mistral Small 4 medium | Mistral | 1 | 5.1 | $0.096 | 5/22 | 10.8s |
| #187 | Qwen3 Coder Next medium | Qwen | 1 | 4.7 | $0.032 | 4/22 | 9.61s |
| #166 | Qwen3 Coder Next none | Qwen | 1 | 5.1 | $0.025 | 5/22 | 9.12s |
| #30 | GPT-5.2 Chat none | OpenAI | 1 | 8.0 | $0.604 | 14/22 | 7.65s |
| #198 | Laguna Xs.2 medium | Poolside | 2 | 4.1 | $0.015 | 6/19 | 6.73s |
| #151 | GLM 5.1 none | Z.ai | 1 | 5.5 | $0.164 | 7/22 | 6.70s |
| #112 | Claude Sonnet 5 none | Anthropic | 2 | 6.3 | $0.548 | 8/22 | 6.04s |
| #161 | Qwen3.6 35B A3B none | Qwen | 1 | 5.3 | $0.061 | 4/22 | 5.52s |
| #66 | Claude Opus 4.8 none | Anthropic | 1 | 7.3 | $1.166 | 13/22 | 4.91s |
| #168 | MiMo-V2.5 none | Xiaomi | 1 | 5.1 | $0.025 | 5/22 | 4.62s |
| #116 | Seed-2.0-Lite none | Bytedance Seed | 1 | 6.2 | $0.066 | 8/22 | 4.40s |
| #154 | MiMo-V2.5-Pro none | Xiaomi | 1 | 5.5 | $0.068 | 6/22 | 4.12s |