Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças.
Modelos exibidos
15
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Gemini 3.6 Flash 10.0
343/343
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #59 | GPT-5.2 medium | OpenAI | 9.9 | 8.4 | $1.182 | 2/2 | 3.12s |
| #64 | GLM 5.3 FlashX max | Z.ai | 9.9 | 8.3 | $0.508 | 2/2 | 2.23s |
| #70 | Claude Sonnet 5 medium | Anthropic | 9.9 | 8.2 | $0.922 | 2/2 | 3.10s |
| #77 | DeepSeek V4 Flash 0731 low | DeepSeek | 9.9 | 8.0 | $0.138 | 2/2 | 3.01s |
| #90 | GLM 5.2 medium | Z.ai | 9.9 | 7.8 | $0.151 | 2/2 | 7.90s |
| #104 | GPT-5.6 Luna high | OpenAI | 9.9 | 7.6 | $0.179 | 2/2 | 1.79s |
| #122 | Kimi K2.7 Code medium | Moonshot AI | 9.9 | 7.4 | $0.655 | 2/2 | 5.39s |
| #123 | GPT-5.6 Luna medium | OpenAI | 9.9 | 7.4 | $0.072 | 2/2 | 2.38s |
| #126 | MiMo-V2.6-Flash medium | Xiaomi | 9.9 | 7.4 | $0.190 | 2/2 | 1.13s |
| #128 | Gemini 3 Flash Preview low | 9.9 | 7.4 | $0.185 | 2/2 | 7.02s | |
| #133 | Gemini 3.1 Flash Lite medium | 9.9 | 7.3 | $0.120 | 2/2 | 2.59s | |
| #136 | Claude Opus 4.8 none | Anthropic | 9.9 | 7.3 | $1.166 | 2/2 | 1.37s |
| #138 | KAT-Coder-Pro V2.5 high | Kwaipilot | 9.9 | 7.2 | $0.506 | 2/2 | 2.67s |
| #157 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 9.9 | 6.9 | $0.478 | 2/2 | 2.58s |
| #170 | MiMo-V2.5-Pro medium | Xiaomi | 9.9 | 6.8 | $0.221 | 2/2 | 2.77s |