AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Categoría AI BENCHY

Ranking de Seguimiento de instrucciones

Mira qué modelos de IA rinden mejor en Seguimiento de instrucciones, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Tiempo de respuesta (promedio) ↑.

Modelos mostrados

15

Promedio de Puntuación de Seguimiento de instrucciones

8.5

Rango Modelo Empresa Puntuación de Seguimiento de instrucciones Puntuación Pruebas correctas Tiempo de respuesta (promedio)
#75 Ring-2.6-1T medium Inclusionai 9.8 6.9 2/2 11.8s
#47 Grok Build 0.1 medium X AI 9.8 7.4 2/2 12.4s
#60 Kimi K2.6 medium Moonshot AI 10.0 7.2 2/2 12.5s
#27 Gemma 4 31B medium Google 10.0 7.8 2/2 12.8s
#130 MiniMax M2.7 medium Minimax 3.8 5.3 0/2 12.8s
#156 Hy3 preview none Tencent 6.3 4.4 1/2 13.0s
#31 DeepSeek V4 Flash high DeepSeek 10.0 7.7 2/2 15.4s
#94 GPT-5 Nano medium OpenAI 9.8 6.3 2/2 15.6s
#89 Hy3 preview low Tencent 10.0 6.4 2/2 16.0s
#18 Qwen3.7 Plus medium Qwen 10.0 8.2 2/2 16.1s
#73 Seed-2.0-Mini medium Bytedance Seed 10.0 6.9 2/2 17.5s
#37 Gemma 4 26B A4B medium Google 10.0 7.6 2/2 17.5s
#139 DeepSeek V4 Flash none DeepSeek 6.5 5.0 1/2 17.5s
#38 Grok 4.3 medium X AI 9.8 7.6 2/2 18.6s
#30 Qwen3.5-27B medium Qwen 10.0 7.8 2/2 19.7s

Mejores modelos por Puntuación de Seguimiento de instrucciones

Puntuación de Seguimiento de instrucciones vs costo total

Mejores modelos por Tiempo de respuesta (promedio)