Fallos por Sin respuesta
Mira qué modelos de IA se encuentran con Sin respuesta con más frecuencia para detectar riesgos de fiabilidad antes de elegir.
Categorías
En la categoría Combinado29 En la categoría Programación18 En la categoría Cultura general13 En la categoría Análisis y extracción de datos8 En la categoría Específico del dominio8 En la categoría Trucos anti-IA4 En la categoría Resolución de acertijos3 En la categoría Llamada de herramientas2 En la categoría Seguimiento de instrucciones2
67/67
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Cantidad de Sin respuesta | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #116 | Seed-2.0-Lite none | Bytedance Seed | 1 | 6.2 | $0.066 | 8/22 | 4.40s |
| #120 | Gemini 3.1 Flash Lite minimal | 1 | 6.1 | $0.047 | 10/22 | 1.86s | |
| #122 | Gemini 3.1 Flash Lite none | 1 | 6.1 | $0.046 | 9/22 | 1.75s | |
| #128 | GPT-5 Nano medium | OpenAI | 1 | 6.1 | $0.114 | 9/22 | 54.9s |
| #130 | Step 3.5 Flash medium | Stepfun | 1 | 6.0 | $0.108 | 11/21 | 174.2s |
| #132 | GPT-5.6 Terra none | OpenAI | 1 | 6.0 | $0.349 | 8/22 | 1.65s |
| #138 | Kimi K2.6 none | Moonshot AI | 1 | 5.8 | $0.184 | 7/22 | 19.6s |
| #140 | Nemotron 3 Super medium | NVIDIA | 1 | 5.7 | $0.050 | 8/22 | 52.0s |
| #143 | Gemini 3.1 Flash Lite high | 1 | 5.6 | $2.044 | 10/18 | 62.0s | |
| #151 | GLM 5.1 none | Z.ai | 1 | 5.5 | $0.164 | 7/22 | 6.70s |
| #154 | MiMo-V2.5-Pro none | Xiaomi | 1 | 5.5 | $0.068 | 6/22 | 4.12s |
| #155 | Kimi K2.5 none | Moonshot AI | 1 | 5.5 | $0.127 | 6/22 | 19.2s |
| #161 | Qwen3.6 35B A3B none | Qwen | 1 | 5.3 | $0.061 | 4/22 | 5.52s |
| #166 | Qwen3 Coder Next none | Qwen | 1 | 5.1 | $0.025 | 5/22 | 9.12s |
| #167 | Mistral Small 4 medium | Mistral | 1 | 5.1 | $0.096 | 5/22 | 10.8s |