Ranking de Específico del dominio
Mira qué modelos de IA rinden mejor en Específico del dominio, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Métrica ↑.
Modelos mostrados
15
Promedio de Puntuación de Específico del dominio
4.7
Mejor modelo
GLM 5 Turbo 2.9
216/216
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Específico del dominio | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #36 | Inkling medium | Thinkingmachines | 5.3 | 8.0 | $0.391 | 1/3 | 35.6s |
| #59 | GPT-5.6 Terra low | OpenAI | 5.3 | 7.5 | $0.519 | 1/3 | 8.34s |
| #65 | Gemini 3 Flash Preview low | 5.3 | 7.4 | $0.177 | 1/3 | 8.05s | |
| #70 | Claude Opus 4.8 none | Anthropic | 5.3 | 7.3 | $1.166 | 1/3 | 1.70s |
| #71 | Step 3.7 Flash low | Stepfun | 5.3 | 7.3 | $0.454 | 1/3 | 43.3s |
| #72 | Kimi K2.6 medium | Moonshot AI | 5.3 | 7.2 | $1.036 | 1/3 | 202.4s |
| #77 | Grok 4.3 medium | X AI | 5.3 | 7.1 | $0.779 | 1/3 | 181.7s |
| #94 | Qwen3.6 35B A3B medium | Qwen | 5.3 | 6.7 | $0.746 | 1/3 | 22.5s |
| #98 | GLM 5V Turbo medium | Z.ai | 5.3 | 6.7 | $0.457 | 1/3 | 38.1s |
| #118 | Claude Sonnet 5 none | Anthropic | 5.3 | 6.3 | $0.548 | 1/3 | 3.28s |
| #120 | Qwen3.5-Flash medium | Qwen | 5.3 | 6.2 | $0.139 | 1/3 | 146.5s |
| #136 | Step 3.5 Flash medium | Stepfun | 5.3 | 6.0 | $0.108 | 1/3 | 170.5s |
| #138 | GPT-5.6 Terra none | OpenAI | 5.3 | 6.0 | $0.349 | 1/3 | 757ms |
| #141 | Hy3 preview high | Tencent | 5.3 | 5.9 | $0.048 | 1/3 | 109.0s |
| #143 | North Mini Code medium | Cohere | 5.3 | 5.9 | $0.000 | 1/3 | 71.4s |