AI BENCHY
Your ad here

Categoría AI BENCHY

Ranking de Resolución de acertijos

Mira qué modelos de IA rinden mejor en Resolución de acertijos, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Pruebas correctas ↑.

Modelos mostrados

15

Promedio de Puntuación de Resolución de acertijos

6.4

Mejor modelo

Kimi K2.6 5.0
Rango Modelo Empresa Puntuación de Resolución de acertijos Puntuación Pruebas correctas Tiempo de respuesta (promedio)
#34 Kimi K2.6 medium Moonshot AI 5.0 7.7 0/3 25.6s
#38 GPT-5.4 Nano medium OpenAI 4.0 7.6 0/3 3.65s
#51 Nemotron 3 Super medium NVIDIA 3.5 6.7 0/3 8.39s
#54 Mercury 2 medium Inception 3.9 6.5 0/3 934ms
#59 Qwen3.5-Flash none Qwen 3.3 6.2 0/3 5.90s
#63 Qwen3.5-35B-A3B none Qwen 3.9 6.1 0/3 1.34s
#68 gpt-oss-120b medium OpenAI 3.2 5.8 0/3 11.8s
#69 Kimi K2.6 none Moonshot AI 3.4 5.8 0/3 1.66s
#73 Mistral Small 4 medium Mistral 3.4 5.7 0/3 2.00s
#74 GLM 4.7 Flash none Z.ai 4.4 5.6 0/3 1.00s
#76 Kimi K2.5 none Moonshot AI 3.1 5.5 0/3 4.73s
#80 MiniMax M2.7 medium Minimax 3.8 5.3 0/3 25.6s
#81 Elephant medium Openrouter 3.7 5.2 0/3 867ms
#83 Mistral Small 4 none Mistral 3.1 5.2 0/3 589ms
#84 gpt-oss-120b none OpenAI 4.5 5.2 0/3 6.86s

Mejores modelos por Puntuación de Resolución de acertijos

Puntuación de Resolución de acertijos vs costo total

Mejores modelos por Tiempo de respuesta (promedio)