Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Custo total ↑.
Modelos exibidos
15
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Dots 3 Note Preview 7.9
343/343
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #248 | GLM 5V Turbo none | Z.ai | 6.5 | 5.6 | $0.052 | 1/2 | 1.97s |
| #96 | Qwen3.7 Flash high | Qwen | 9.8 | 7.8 | $0.052 | 2/2 | 9.41s |
| #263 | Laguna S 2.1 medium | Poolside | 4.2 | 5.4 | $0.053 | 0/2 | 400ms |
| #270 | Inkling Small none | Thinkingmachines | 6.3 | 5.3 | $0.054 | 1/2 | 767ms |
| #292 | DeepSeek V3.2 none | DeepSeek | 10.0 | 5.0 | $0.054 | 2/2 | 1.52s |
| #239 | Nemotron 3 Super medium | NVIDIA | 7.3 | 5.7 | $0.054 | 1/2 | 6.97s |
| #241 | Inkling Small low | Thinkingmachines | 9.9 | 5.7 | $0.055 | 2/2 | 1.89s |
| #196 | GLM 5.3 FlashX medium | Z.ai | 10.0 | 6.4 | $0.056 | 2/2 | 1.51s |
| #132 | GLM 5.3 Flash high | Z.ai | 10.0 | 7.3 | $0.057 | 2/2 | 2.06s |
| #323 | Grok 4.20 none | X AI | 6.3 | 4.1 | $0.057 | 1/2 | 445ms |
| #93 | Qwen3.8 27B medium | Qwen | 10.0 | 7.8 | ~$0.058 | 2/2 | 2.54s |
| #182 | Qwen3.5-27B none | Qwen | 6.3 | 6.6 | $0.058 | 1/2 | 1.03s |
| #275 | Qwen3.6 35B A3B none | Qwen | 6.2 | 5.3 | $0.061 | 1/2 | 1.86s |
| #217 | Qwen3.6 Flash none | Qwen | 6.3 | 6.1 | $0.062 | 1/2 | 1.10s |
| #256 | Qwen3.6 27B none | Qwen | 6.2 | 5.5 | $0.062 | 1/2 | 1.92s |