Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças.
Modelos exibidos
15
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Gemini 3.6 Flash 10.0
343/343
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #142 | Muse Glimmer 30B medium | Meta | 9.8 | 7.2 | $0.227 | 2/2 | 5.34s |
| #145 | Step 3.7 Flash low | Stepfun | 9.8 | 7.1 | $0.390 | 2/2 | 1.58s |
| #154 | Grok 4.20 medium | X AI | 9.8 | 7.0 | $0.805 | 2/2 | 4.26s |
| #163 | Step 3.7 Flash high | Stepfun | 9.8 | 6.8 | $1.229 | 2/2 | 1.52s |
| #164 | Seed-2.0-Code medium | Bytedance Seed | 9.8 | 6.8 | $1.153 | 2/2 | 10.3s |
| #174 | GLM 5.2 none | Z.ai | 9.8 | 6.7 | $0.103 | 2/2 | 3.84s |
| #187 | Mercury 2.5 Preview high | Inception | 9.8 | 6.6 | $0.030 | 2/2 | 1.05s |
| #190 | Laguna XS 2.1 medium | Poolside | 9.8 | 6.5 | $0.068 | 2/2 | 2.57s |
| #193 | Qwen3.6 Max Preview none | Qwen | 9.8 | 6.4 | $0.228 | 2/2 | 1.40s |
| #200 | Ring-2.6-1T medium | Inclusionai | 9.8 | 6.4 | $0.102 | 2/2 | 11.8s |
| #204 | MiMo-V2.6-Pro none | Xiaomi | 9.8 | 6.2 | $0.122 | 2/2 | 803ms |
| #215 | Inkling low | Thinkingmachines | 9.8 | 6.1 | $0.187 | 2/2 | 1.81s |
| #223 | Grok 4.20 Beta medium | X AI | 9.8 | 6.0 | $0.750 | 2/2 | 4.89s |
| #225 | Gemini 3 PRO Preview medium | 9.8 | 6.0 | $0.385 | 2/2 | 3.26s | |
| #226 | GPT-5 Nano medium | OpenAI | 9.8 | 6.0 | $0.118 | 2/2 | 15.6s |