Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Métrica ↑.
Modelos exibidos
11
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Granite 4.2 8B 3.0
311/311
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #187 | Qwen3.5-Flash medium | Qwen | 10.0 | 6.1 | $0.142 | 2/2 | 63.5s |
| #193 | Nemotron 3 Ultra none | NVIDIA | 10.0 | 6.1 | $0.084 | 2/2 | 1.46s |
| #195 | Gemini 2.5 Flash none | 10.0 | 6.0 | $0.017 | 2/2 | 590ms | |
| #205 | Hy3 preview high | Tencent | 10.0 | 5.9 | $0.135 | 2/2 | 34.4s |
| #206 | GLM 5.3 Flash low | Z.ai | 10.0 | 5.9 | $0.015 | 2/2 | 1.65s |
| #213 | GLM 5 none | Z.ai | 10.0 | 5.7 | $0.027 | 2/2 | 1.48s |
| #226 | KAT-Coder-Air V2.5 medium | Kwaipilot | 10.0 | 5.6 | $0.048 | 2/2 | 1.50s |
| #230 | Hy3 preview low | Tencent | 10.0 | 5.5 | $0.042 | 2/2 | 16.0s |
| #262 | DeepSeek V3.2 none | DeepSeek | 10.0 | 5.0 | $0.054 | 2/2 | 1.52s |
| #279 | Laguna M.1 medium | Poolside | 10.0 | 4.7 | $0.033 | 2/2 | 4.30s |
| #294 | Laguna Xs.2 medium | Poolside | 10.0 | 4.1 | $0.015 | 2/2 | 1.68s |