Ranking de Resolución de acertijos
Mira qué modelos de IA rinden mejor en Resolución de acertijos, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Tiempo de respuesta (promedio) ↑.
Modelos mostrados
15
Promedio de Puntuación de Resolución de acertijos
6.7
Mejor modelo
Step 3.5 Flash 0.0
210/210
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Resolución de acertijos | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #124 | Qwen3.6 Flash none | Qwen | 3.5 | 6.1 | $0.062 | 0/3 | 1.21s |
| #132 | GPT-5.6 Terra none | OpenAI | 5.3 | 6.0 | $0.349 | 1/3 | 1.23s |
| #187 | Qwen3 Coder Next medium | Qwen | 3.0 | 4.7 | $0.032 | 0/3 | 1.25s |
| #180 | GPT-5.4 Nano none | OpenAI | 5.4 | 4.8 | $0.041 | 1/3 | 1.25s |
| #87 | GPT-5.5 none | OpenAI | 7.7 | 6.9 | $0.544 | 2/3 | 1.29s |
| #154 | MiMo-V2.5-Pro none | Xiaomi | 6.7 | 5.5 | $0.068 | 1/3 | 1.30s |
| #127 | Qwen3.5-35B-A3B none | Qwen | 3.7 | 6.1 | $0.106 | 0/3 | 1.35s |
| #103 | Qwen3.5-27B none | Qwen | 6.7 | 6.5 | $0.090 | 1/3 | 1.38s |
| #207 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 2.9 | 3.4 | $0.000 | 0/3 | 1.40s |
| #138 | Kimi K2.6 none | Moonshot AI | 3.1 | 5.8 | $0.184 | 0/3 | 1.40s |
| #105 | Gemini 3.1 Flash Lite low | 10.0 | 6.5 | $0.621 | 3/3 | 1.40s | |
| #139 | GPT-5.4 none | OpenAI | 5.6 | 5.8 | $0.397 | 1/3 | 1.44s |
| #88 | Gemini 3.5 Flash minimal | 10.0 | 6.8 | $0.300 | 3/3 | 1.45s | |
| #151 | GLM 5.1 none | Z.ai | 7.7 | 5.5 | $0.164 | 2/3 | 1.45s |
| #83 | GPT-5.6 Sol none | OpenAI | 7.7 | 6.9 | $0.524 | 2/3 | 1.49s |