Fallos por Sin respuesta
Mira qué modelos de IA se encuentran con Sin respuesta con más frecuencia para detectar riesgos de fiabilidad antes de elegir.
Categorías
En la categoría Combinado29 En la categoría Programación18 En la categoría Cultura general13 En la categoría Análisis y extracción de datos8 En la categoría Específico del dominio8 En la categoría Trucos anti-IA4 En la categoría Resolución de acertijos3 En la categoría Llamada de herramientas2 En la categoría Seguimiento de instrucciones2
67/67
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Cantidad de Sin respuesta | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #49 | GLM 5 Turbo medium | Z.ai | 1 | 7.6 | $0.323 | 14/21 | 23.0s |
| #60 | LongCat 2.0 medium | Meituan | 1 | 7.4 | $0.478 | 12/22 | 136.6s |
| #66 | Claude Opus 4.8 none | Anthropic | 1 | 7.3 | $1.166 | 13/22 | 4.91s |
| #67 | Step 3.7 Flash low | Stepfun | 1 | 7.3 | $0.454 | 12/22 | 20.7s |
| #68 | Kimi K2.6 medium | Moonshot AI | 1 | 7.2 | $1.036 | 12/22 | 110.0s |
| #73 | Grok 4.3 medium | X AI | 1 | 7.1 | $0.779 | 13/22 | 47.4s |
| #74 | GLM 5.1 medium | Z.ai | 1 | 7.1 | $0.535 | 13/22 | 46.8s |
| #80 | Seed-2.0-Mini medium | Bytedance Seed | 1 | 7.0 | $0.101 | 11/22 | 92.5s |
| #89 | Gemini 3 Flash Preview none | 1 | 6.8 | $0.085 | 13/22 | 2.95s | |
| #90 | Qwen3.6 35B A3B medium | Qwen | 1 | 6.7 | $0.746 | 13/22 | 58.1s |
| #91 | LongCat 2.0 low | Meituan | 1 | 6.7 | $0.391 | 10/22 | 100.3s |
| #101 | MiMo-V2.5 medium | Xiaomi | 1 | 6.5 | $0.082 | 12/22 | 32.2s |
| #102 | Laguna XS 2.1 medium | Poolside | 1 | 6.5 | $0.068 | 9/22 | 47.9s |
| #106 | Gemini 3.1 Flash Lite Preview none | 1 | 6.4 | $0.052 | 12/22 | 1.58s | |
| #110 | Gemma 4 31B medium | 1 | 6.3 | $0.163 | 14/22 | 75.4s |