Resolución de acertijos: Formato extra
Resolución de acertijos
Formato extra
Mira qué modelos de IA tienen más probabilidades de caer en Formato extra dentro de Resolución de acertijos, para detectar puntos débiles más rápido. Ordenar por: Pruebas correctas ↑.
Motivos de fallo
8/8
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Cantidad de Formato extra | Puntuación de categoría | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #111 | LongCat 2.0 none | Meituan | 1 | 4.0 | $0.044 | 0/3 | 2.74s |
| #150 | DeepSeek V4 Flash none | DeepSeek | 1 | 3.1 | $0.044 | 0/3 | 23.7s |
| #109 | Mimo V2 PRO medium | Xiaomi | 1 | 6.4 | $0.333 | 1/3 | 5.08s |
| #112 | Claude Sonnet 5 none | Anthropic | 1 | 6.0 | $0.548 | 1/3 | 3.22s |
| #159 | GPT-5.6 Luna none | OpenAI | 1 | 5.3 | $0.142 | 1/3 | 790ms |
| #164 | Inkling none | Thinkingmachines | 1 | 5.6 | $0.147 | 1/3 | 931ms |
| #63 | Claude Sonnet 4.6 none | Anthropic | 1 | 7.7 | $0.661 | 2/3 | 2.53s |
| #66 | Claude Opus 4.8 none | Anthropic | 1 | 7.7 | $1.166 | 2/3 | 2.74s |