AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Categoría AI BENCHY

Ranking de Resolución de acertijos

Mira qué modelos de IA rinden mejor en Resolución de acertijos, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Métrica ↑.

Modelos mostrados

15

Promedio de Puntuación de Resolución de acertijos

6.4

Mejor modelo

GLM 4.7 Flash 2.9
Rango Modelo Empresa Puntuación de Resolución de acertijos Puntuación Pruebas correctas Tiempo de respuesta (promedio)
#52 Grok 4.1 Fast medium X AI 5.3 6.7 1/3 8.08s
#57 GPT-5 Nano medium OpenAI 5.3 6.3 1/3 19.8s
#30 Step 3.5 Flash medium Stepfun 5.3 7.9 1/3 7.72s
#58 GLM 5V Turbo none Z.ai 5.3 6.2 1/3 2.22s
#46 Kimi K2.5 medium Moonshot AI 5.3 7.0 1/3 45.4s
#78 Trinity Large Preview none Arcee AI 5.4 5.3 1/3 3.30s
#70 Qwen3.5-122B-A10B none Qwen 5.4 5.7 1/3 982ms
#86 GPT-5.4 Mini none OpenAI 5.4 5.1 1/3 860ms
#77 GLM 5 Turbo none Z.ai 5.5 5.5 1/3 2.43s
#48 Gemma 4 31B none Google 5.5 6.9 1/3 2.95s
#66 GPT-5.4 none OpenAI 5.6 5.9 1/3 1.52s
#45 GPT-5 Mini medium OpenAI 5.6 7.0 1/3 14.1s
#60 Gemma 4 26B A4B none Google 5.7 6.2 1/3 739ms
#62 Gemini 2.5 Flash none Google 5.7 6.2 1/3 576ms
#75 GLM 5.1 none Z.ai 5.7 5.6 1/3 1.48s

Mejores modelos por Puntuación de Resolución de acertijos

Puntuación de Resolución de acertijos vs costo total

Mejores modelos por Tiempo de respuesta (promedio)