Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças.
Modelos exibidos
15
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Gemini 3.6 Flash 10.0
343/343
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #44 | Claude Opus 4.7 medium | Anthropic | 10.0 | 8.7 | $1.476 | 2/2 | 1.57s |
| #48 | Claude Fable 5 medium | Anthropic | 10.0 | 8.6 | $3.004 | 2/2 | 5.90s |
| #49 | Qwen3.6 Max Preview medium | Qwen | 10.0 | 8.6 | $1.132 | 2/2 | 24.3s |
| #50 | Qwen3.8 Max low | Qwen | 10.0 | 8.6 | $0.702 | 2/2 | 4.01s |
| #51 | GPT-5.4 medium | OpenAI | 10.0 | 8.5 | $1.560 | 2/2 | 3.11s |
| #52 | DeepSeek V4.1 Flash low | DeepSeek | 10.0 | 8.5 | $0.224 | 2/2 | 8.38s |
| #53 | DeepSeek V4.1 Flash high | DeepSeek | 10.0 | 8.5 | $0.287 | 2/2 | 7.06s |
| #54 | DeepSeek V4.1 Flash medium | DeepSeek | 10.0 | 8.5 | $0.272 | 2/2 | 9.69s |
| #65 | DeepSeek V4.1 Flash max | DeepSeek | 10.0 | 8.3 | $0.537 | 2/2 | 7.64s |
| #72 | GPT-5 Mini medium | OpenAI | 10.0 | 8.1 | $0.241 | 2/2 | 11.6s |
| #79 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $0.799 | 2/2 | 4.26s |
| #81 | GPT-5.6 Terra high | OpenAI | 10.0 | 8.0 | $0.836 | 2/2 | 2.14s |
| #83 | Kimi K3 max | Moonshot AI | 10.0 | 7.9 | $3.467 | 2/2 | 7.66s |
| #86 | Qwen3.8 27B low | Qwen | 10.0 | 7.9 | ~$0.071 | 2/2 | 2.43s |
| #87 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.277 | 2/2 | 16.1s |