Ranking de Específico do domínio
Veja quais modelos de IA vão melhor em Específico do domínio, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Testes corretos ↓.
Modelos exibidos
15
Média de Pontuação de Específico do domínio
4.4
Melhor modelo
Step 3.5 Flash 3.3
316/316
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Específico do domínio | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #92 | Solar Pro 4 xhigh | Upstage | 3.0 | 7.6 | $0.050 | 0/3 | 287.7s |
| #93 | Nemotron 3 Ultra medium | NVIDIA | 3.6 | 7.6 | $0.701 | 0/3 | 35.2s |
| #97 | MiniMax M3 medium | Minimax | 3.2 | 7.5 | $0.300 | 0/3 | 235.0s |
| #98 | GPT 5.3 Chat none | OpenAI | 2.9 | 7.5 | $0.533 | 0/3 | 12.7s |
| #102 | GPT-5.4 Mini medium | OpenAI | 3.6 | 7.5 | $0.786 | 0/3 | 71.1s |
| #103 | Grok Build 0.1 medium | X AI | 2.9 | 7.5 | $1.130 | 0/3 | 175.9s |
| #107 | Kimi K2.7 Code medium | Moonshot AI | 3.7 | 7.4 | $0.687 | 0/3 | 184.2s |
| #108 | GPT-5.6 Luna medium | OpenAI | 2.9 | 7.4 | $0.072 | 0/3 | 18.5s |
| #109 | LongCat 2.0 medium | Meituan | 3.0 | 7.4 | $0.499 | 0/3 | 390.6s |
| #110 | Qwen3.8 2.4T A95B high | Qwen | 4.1 | 7.4 | $2.357 | 0/3 | 301.1s |
| #111 | Grok 4.6 low | X AI | 3.0 | 7.4 | $0.449 | 0/3 | 18.2s |
| #114 | GLM 5.3 high | Z.ai | 2.9 | 7.3 | $0.403 | 0/3 | 112.3s |
| #115 | KAT-Coder-Pro V2.5 low | Kwaipilot | 3.5 | 7.3 | $0.400 | 0/3 | 22.9s |
| #116 | GLM 5.3 Flash high | Z.ai | 3.0 | 7.3 | $0.029 | 0/3 | 85.9s |
| #117 | Gemini 3.1 Flash Lite medium | 2.9 | 7.3 | $0.120 | 0/3 | 3.93s |