Ranking de Resolución de acertijos
Mira qué modelos de IA rinden mejor en Resolución de acertijos, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Costo total ↑.
Modelos mostrados
6
Promedio de Puntuación de Resolución de acertijos
6.7
Mejor modelo
North Mini Code 3.3
216/216
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Resolución de acertijos | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #169 | Gemini 3.1 Flash Lite Preview high | 7.7 | 5.3 | $2.310 | 2/3 | 46.7s | |
| #47 | Claude Opus 4.6 medium | Anthropic | 7.7 | 7.7 | $3.059 | 2/3 | 4.71s |
| #37 | Kimi K3 max | Moonshot AI | 10.0 | 8.0 | $3.112 | 3/3 | 7.36s |
| #20 | Claude Fable 5 medium | Anthropic | 7.7 | 8.6 | $3.478 | 2/3 | 5.18s |
| #13 | GPT-5.5 medium | OpenAI | 10.0 | 9.0 | $4.137 | 3/3 | 6.76s |
| #187 | Grok 4.20 Multi Agent Beta medium | X AI | 6.7 | 4.8 | $5.599 | 1/3 | 5.19s |