Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Métrica ↑.
Modelos exibidos
15
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Granite 4.2 8B 3.0
311/311
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #20 | Claude Fable 5.1 high | Anthropic | 10.0 | 9.0 | $3.364 | 2/2 | 5.60s |
| #22 | GPT-5.5 medium | OpenAI | 10.0 | 9.0 | $4.163 | 2/2 | 3.36s |
| #23 | Qwen3.8 Max medium | Qwen | 10.0 | 9.0 | $0.771 | 2/2 | 3.49s |
| #25 | GPT-5.3-Codex medium | OpenAI | 10.0 | 8.9 | $0.988 | 2/2 | 3.04s |
| #31 | Claude Opus 4.8 medium | Anthropic | 10.0 | 8.8 | $1.983 | 2/2 | 3.32s |
| #32 | Claude Opus 5 low | Anthropic | 10.0 | 8.7 | $1.121 | 2/2 | 4.13s |
| #35 | Claude Opus 4.7 medium | Anthropic | 10.0 | 8.7 | $1.476 | 2/2 | 1.57s |
| #39 | Claude Fable 5 medium | Anthropic | 10.0 | 8.6 | $3.004 | 2/2 | 5.90s |
| #40 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.6 | $1.132 | 2/2 | 24.3s |
| #41 | Qwen3.8 Max low | Qwen | 10.0 | 8.6 | $0.702 | 2/2 | 4.01s |
| #42 | GPT-5.4 medium | OpenAI | 10.0 | 8.5 | $1.560 | 2/2 | 3.11s |
| #57 | GPT-5 Mini medium | OpenAI | 10.0 | 8.1 | $0.241 | 2/2 | 11.6s |
| #63 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $1.188 | 2/2 | 4.26s |
| #65 | GPT-5.6 Terra high | OpenAI | 10.0 | 8.0 | $0.836 | 2/2 | 2.14s |
| #66 | Kimi K3 max | Moonshot AI | 10.0 | 7.9 | $3.467 | 2/2 | 7.66s |