Ranking de Específico del dominio
Mira qué modelos de IA rinden mejor en Específico del dominio, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Pruebas correctas ↓.
Modelos mostrados
15
Promedio de Puntuación de Específico del dominio
4.4
Mejor modelo
Step 3.5 Flash 3.3
316/316
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Específico del dominio | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #92 | Solar Pro 4 xhigh | Upstage | 3.0 | 7.6 | $0.050 | 0/3 | 287.7s |
| #93 | Nemotron 3 Ultra medium | NVIDIA | 3.6 | 7.6 | $0.701 | 0/3 | 35.2s |
| #97 | MiniMax M3 medium | Minimax | 3.2 | 7.5 | $0.300 | 0/3 | 235.0s |
| #98 | GPT 5.3 Chat none | OpenAI | 2.9 | 7.5 | $0.533 | 0/3 | 12.7s |
| #102 | GPT-5.4 Mini medium | OpenAI | 3.6 | 7.5 | $0.786 | 0/3 | 71.1s |
| #103 | Grok Build 0.1 medium | X AI | 2.9 | 7.5 | $1.130 | 0/3 | 175.9s |
| #107 | Kimi K2.7 Code medium | Moonshot AI | 3.7 | 7.4 | $0.687 | 0/3 | 184.2s |
| #108 | GPT-5.6 Luna medium | OpenAI | 2.9 | 7.4 | $0.072 | 0/3 | 18.5s |
| #109 | LongCat 2.0 medium | Meituan | 3.0 | 7.4 | $0.499 | 0/3 | 390.6s |
| #110 | Qwen3.8 2.4T A95B high | Qwen | 4.1 | 7.4 | $2.357 | 0/3 | 301.1s |
| #111 | Grok 4.6 low | X AI | 3.0 | 7.4 | $0.449 | 0/3 | 18.2s |
| #114 | GLM 5.3 high | Z.ai | 2.9 | 7.3 | $0.403 | 0/3 | 112.3s |
| #115 | KAT-Coder-Pro V2.5 low | Kwaipilot | 3.5 | 7.3 | $0.400 | 0/3 | 22.9s |
| #116 | GLM 5.3 Flash high | Z.ai | 3.0 | 7.3 | $0.029 | 0/3 | 85.9s |
| #117 | Gemini 3.1 Flash Lite medium | 2.9 | 7.3 | $0.120 | 0/3 | 3.93s |