Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Tempo de resposta (médio) ↑.
Modelos exibidos
15
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Granite 4.1 8B 3.6
311/311
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #106 | Grok 4.6 low | X AI | 9.8 | 7.4 | $0.449 | 2/2 | 6.64s |
| #155 | LongCat 2.0 high | Meituan | 6.5 | 6.7 | $0.492 | 1/2 | 6.96s |
| #212 | Nemotron 3 Super medium | NVIDIA | 7.3 | 5.7 | $0.050 | 1/2 | 6.97s |
| #59 | Inkling high | Thinkingmachines | 9.8 | 8.0 | $1.046 | 2/2 | 7.00s |
| #107 | Gemini 3 Flash Preview low | 9.9 | 7.4 | $0.185 | 2/2 | 7.02s | |
| #80 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.228 | 2/2 | 7.25s |
| #77 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 7.8 | $0.236 | 2/2 | 7.26s |
| #300 | Grok Build 0.1 none | X AI | 9.8 | 4.0 | $0.547 | 2/2 | 7.36s |
| #104 | LongCat 2.0 medium | Meituan | 6.5 | 7.4 | $0.499 | 1/2 | 7.38s |
| #19 | Qwen3.7 Max medium | Qwen | 10.0 | 9.1 | $1.157 | 2/2 | 7.46s |
| #129 | GLM 5.1 medium | Z.ai | 6.4 | 7.0 | $0.727 | 1/2 | 7.47s |
| #49 | Seed 2.1 Turbo medium | Bytedance Seed | 9.8 | 8.4 | $1.951 | 2/2 | 7.48s |
| #283 | Qwen3 Coder Next medium | Qwen | 6.3 | 4.6 | $0.034 | 1/2 | 7.49s |
| #162 | Qwen3.6 35B A3B medium | Qwen | 10.0 | 6.6 | $0.672 | 2/2 | 7.50s |
| #71 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.418 | 2/2 | 7.54s |