Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças.
Modelos exibidos
15
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Gemini 3.6 Flash 10.0
343/343
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #88 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.418 | 2/2 | 7.54s |
| #91 | GPT-5.6 Terra medium | OpenAI | 10.0 | 7.8 | $0.523 | 2/2 | 1.43s |
| #92 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.126 | 2/2 | 2.61s |
| #93 | Qwen3.8 27B medium | Qwen | 10.0 | 7.8 | ~$0.058 | 2/2 | 2.54s |
| #94 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 7.8 | $0.236 | 2/2 | 7.26s |
| #97 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.228 | 2/2 | 7.25s |
| #99 | Claude Opus 4.6 medium | Anthropic | 10.0 | 7.7 | $2.961 | 2/2 | 2.43s |
| #101 | DeepSeek V4 Flash 0423 high | DeepSeek | 10.0 | 7.6 | $0.026 | 2/2 | 15.4s |
| #103 | GLM 5 Turbo medium | Z.ai | 10.0 | 7.6 | $0.323 | 2/2 | 5.38s |
| #107 | Claude Opus 5 none | Anthropic | 10.0 | 7.5 | $1.550 | 2/2 | 2.81s |
| #110 | GPT-5.6 Terra low | OpenAI | 10.0 | 7.5 | $0.420 | 2/2 | 1.48s |
| #114 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 10.0 | 7.5 | $0.459 | 2/2 | 31.9s |
| #115 | Qwen3.5-27B medium | Qwen | 10.0 | 7.5 | $0.982 | 2/2 | 19.7s |
| #119 | Gemini 3.8 Flash low | 10.0 | 7.5 | $0.239 | 2/2 | 2.79s | |
| #120 | Gemini 3.1 Flash Lite Preview medium | 10.0 | 7.4 | $0.117 | 2/2 | 1.91s |