Ranking de Específico del dominio
Mira qué modelos de IA rinden mejor en Específico del dominio, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Pruebas correctas ↓.
Modelos mostrados
15
Promedio de Puntuación de Específico del dominio
4.4
Mejor modelo
Step 3.5 Flash 3.3
319/319
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Específico del dominio | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #68 | Muse Spark 1.1 high | Meta | 2.9 | 8.0 | $2.253 | 0/3 | 94.7s |
| #69 | DeepSeek V4 Flash 0731 low | DeepSeek | 3.0 | 8.0 | $0.072 | 0/3 | 255.5s |
| #70 | DeepSeek V4 Flash 0731 high | DeepSeek | 3.5 | 8.0 | $0.134 | 0/3 | 458.6s |
| #71 | GLM 5.2 high | Z.ai | 3.1 | 8.0 | $1.188 | 0/3 | 126.8s |
| #75 | GPT-5.2 Chat none | OpenAI | 3.0 | 7.9 | $0.594 | 0/3 | 23.7s |
| #78 | Qwen3.7 Plus medium | Qwen | 3.6 | 7.9 | $0.277 | 0/3 | 60.1s |
| #79 | Qwen3.6 Plus medium | Qwen | 2.9 | 7.8 | $0.418 | 0/3 | 46.4s |
| #80 | Gemini 3.5 Flash Lite medium | 4.1 | 7.8 | $0.272 | 0/3 | 5.34s | |
| #81 | GLM 5.2 medium | Z.ai | 4.1 | 7.8 | $0.224 | 0/3 | 45.5s |
| #83 | Claude Sonnet 4.6 medium | Anthropic | 3.0 | 7.8 | $2.126 | 0/3 | 58.4s |
| #85 | Seed-2.0-Lite medium | Bytedance Seed | 3.6 | 7.8 | $0.236 | 0/3 | 84.4s |
| #87 | Qwen3.7 Flash high | Qwen | 2.9 | 7.8 | $0.052 | 0/3 | 34.4s |
| #88 | GLM 5 medium | Z.ai | 3.5 | 7.7 | $0.228 | 0/3 | 0ms |
| #89 | Seed-2.0-Code low | Bytedance Seed | 4.1 | 7.7 | $0.767 | 0/3 | 238.4s |
| #90 | Claude Opus 4.6 medium | Anthropic | 3.0 | 7.7 | $2.961 | 0/3 | 42.5s |