Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças.
Modelos exibidos
15
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Gemini 3.6 Flash 10.0
343/343
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #320 | Elephant Alpha medium | Openrouter | 9.8 | 4.3 | $0.000 | 2/2 | 987ms |
| #17 | Grok 4.6 high | X AI | 9.8 | 9.3 | $1.908 | 2/2 | 13.8s |
| #24 | Seed 2.1 Turbo low | Bytedance Seed | 9.8 | 9.1 | $1.546 | 2/2 | 5.05s |
| #30 | Grok 4.5 high | X AI | 9.8 | 9.0 | $2.252 | 2/2 | 6.23s |
| #31 | Qwen3.8 Max (0902) high | Qwen | 9.8 | 8.9 | $2.736 | 2/2 | 7.55s |
| #35 | Seed 2.1 Turbo high | Bytedance Seed | 9.8 | 8.9 | $1.797 | 2/2 | 7.66s |
| #39 | Gemini 3.5 Flash Lite high | 9.8 | 8.8 | $0.540 | 2/2 | 2.16s | |
| #45 | Muse Spark 1.2 high | Meta | 9.8 | 8.7 | $1.771 | 2/2 | 5.43s |
| #46 | Muse Spark 1.2 medium | Meta | 9.8 | 8.6 | $1.339 | 2/2 | 4.40s |
| #55 | Grok 4.5 medium | X AI | 9.8 | 8.5 | $2.042 | 2/2 | 6.06s |
| #56 | Muse Spark 1.2 low | Meta | 9.8 | 8.4 | $0.655 | 2/2 | 2.95s |
| #57 | Grok 4.6 medium | X AI | 9.8 | 8.4 | $1.713 | 2/2 | 12.8s |
| #58 | Grok 4.5 low | X AI | 9.8 | 8.4 | $0.945 | 2/2 | 2.80s |
| #60 | Qwen3.8 27B high | Qwen | 9.8 | 8.4 | ~$0.287 | 2/2 | 8.24s |
| #62 | Seed 2.1 Turbo medium | Bytedance Seed | 9.8 | 8.4 | $1.951 | 2/2 | 7.48s |