Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças.
Modelos exibidos
15
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Gemini 3.6 Flash 10.0
343/343
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #213 | Gemini 3.1 Flash Lite none | 10.0 | 6.1 | $0.046 | 2/2 | 859ms | |
| #214 | Qwen3.5-Flash medium | Qwen | 10.0 | 6.1 | $0.142 | 2/2 | 63.5s |
| #220 | Nemotron 3 Ultra none | NVIDIA | 10.0 | 6.1 | $0.084 | 2/2 | 1.46s |
| #222 | Gemini 2.5 Flash none | 10.0 | 6.0 | $0.017 | 2/2 | 590ms | |
| #232 | Hy3 preview high | Tencent | 10.0 | 5.9 | $0.135 | 2/2 | 34.4s |
| #233 | GLM 5.3 Flash low | Z.ai | 10.0 | 5.9 | $0.030 | 2/2 | 1.65s |
| #240 | GLM 5 none | Z.ai | 10.0 | 5.7 | $0.027 | 2/2 | 1.48s |
| #253 | KAT-Coder-Air V2.5 medium | Kwaipilot | 10.0 | 5.6 | $0.048 | 2/2 | 1.50s |
| #257 | Hy3 preview low | Tencent | 10.0 | 5.5 | $0.042 | 2/2 | 16.0s |
| #292 | DeepSeek V3.2 none | DeepSeek | 10.0 | 5.0 | $0.054 | 2/2 | 1.52s |
| #309 | Laguna M.1 medium | Poolside | 10.0 | 4.7 | $0.033 | 2/2 | 4.30s |
| #324 | Laguna Xs.2 medium | Poolside | 10.0 | 4.1 | $0.015 | 2/2 | 1.68s |
| #16 | GPT-5.5 low | OpenAI | 9.9 | 9.3 | $1.257 | 2/2 | 3.74s |
| #27 | Gemini 3.5 Flash medium | 9.9 | 9.0 | $0.665 | 2/2 | 2.70s | |
| #36 | Gemini 3.5 Flash low | 9.9 | 8.8 | $0.449 | 2/2 | 1.86s |