AI BENCHY
Your ad here

Categoría AI BENCHY

Ranking de Resolución de acertijos

Mira qué modelos de IA rinden mejor en Resolución de acertijos, cuáles se mantienen fiables y dónde aparecen las mayores diferencias.

Modelos mostrados

15

Promedio de Puntuación de Resolución de acertijos

6.4

Rango Modelo Empresa Puntuación de Resolución de acertijos Puntuación Pruebas correctas Tiempo de respuesta (promedio)
#1 Gemini 3 Flash Preview medium Google 10.0 10.0 3/3 4.43s
#2 Gemini 3.1 Pro Preview medium Google 10.0 9.6 3/3 7.15s
#3 Claude Opus 4.7 medium Anthropic 10.0 9.2 3/3 2.51s
#4 Claude Opus 4.7 none Anthropic 10.0 9.2 3/3 2.58s
#5 Gemini 3 Flash Preview low Google 10.0 8.8 3/3 6.11s
#8 Qwen3.5 Plus 2026-02-15 medium Qwen 10.0 8.5 3/3 34.6s
#9 Qwen3.6 Plus Preview medium Qwen 10.0 8.5 3/3 6.11s
#12 Gemini 3 PRO Preview medium Google 10.0 8.4 3/3 3.91s
#13 GLM 5 medium Z.ai 10.0 8.4 3/3 15.6s
#19 Qwen3.5-122B-A10B medium Qwen 10.0 8.1 3/3 17.2s
#20 Qwen3.6 Plus medium Qwen 10.0 8.1 3/3 6.11s
#22 Gemini 3.1 Flash Lite Preview low Google 10.0 8.1 3/3 2.76s
#26 Claude Sonnet 4.6 medium Anthropic 10.0 8.0 3/3 4.80s
#29 Gemini 3.1 Flash Lite Preview none Google 10.0 7.9 3/3 972ms
#36 GPT-5.3 Chat none OpenAI 10.0 7.7 3/3 2.93s

Mejores modelos por Puntuación de Resolución de acertijos

Puntuación de Resolución de acertijos vs costo total

Mejores modelos por Tiempo de respuesta (promedio)