AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Categoría AI BENCHY

Ranking de Específico del dominio

Mira qué modelos de IA rinden mejor en Específico del dominio, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Tiempo de respuesta (promedio) ↓.

Modelos mostrados

15

Promedio de Puntuación de Específico del dominio

4.8

Mejor modelo

MiniMax M2.5 2.9
Rango Modelo Empresa Puntuación de Específico del dominio Puntuación Pruebas correctas Tiempo de respuesta (promedio)
#39 Qwen3.6 Flash medium Qwen 3.5 7.5 0/3 14.6s
#10 Claude Opus 4.8 medium Anthropic 5.3 8.7 1/3 14.2s
#2 Gemini 3.5 Flash high Google 7.6 9.6 2/3 14.1s
#63 GPT-5.3 Chat none OpenAI 3.5 7.2 0/3 13.0s
#107 Laguna Xs.2 medium Poolside 4.1 5.8 0/3 11.1s
#20 Gemini 3.5 Flash none Google 7.6 8.1 2/3 10.6s
#79 Hunter Alpha medium OpenRouter 3.0 6.7 0/3 10.5s
#51 Mimo V2 PRO medium Xiaomi 5.3 7.4 1/3 8.82s
#111 Owl Alpha medium Openrouter 5.3 5.7 1/3 8.58s
#16 Gemini 3 Flash Preview low Google 5.3 8.4 1/3 8.05s
#153 Qwen3.6 35B A3B none Qwen 3.5 4.6 0/3 7.45s
#35 Gemini 3 PRO Preview medium Google 5.3 7.6 1/3 7.01s
#81 Mercury 2 medium Inception 2.9 6.6 0/3 6.48s
#141 Nemotron 3 Super none NVIDIA 3.6 4.9 0/3 6.23s
#132 Mistral Small 4 medium Mistral 5.3 5.3 1/3 6.11s

Mejores modelos por Puntuación de Específico del dominio

Puntuación de Específico del dominio vs costo total

Mejores modelos por Tiempo de respuesta (promedio)