Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Custo total ↑.
Modelos exibidos
15
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Dots 3 Note Preview 7.9
343/343
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #52 | DeepSeek V4.1 Flash low | DeepSeek | 10.0 | 8.5 | $0.224 | 2/2 | 8.38s |
| #142 | Muse Glimmer 30B medium | Meta | 9.8 | 7.2 | $0.227 | 2/2 | 5.34s |
| #97 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.228 | 2/2 | 7.25s |
| #193 | Qwen3.6 Max Preview none | Qwen | 9.8 | 6.4 | $0.228 | 2/2 | 1.40s |
| #244 | Kimi K2.6 none | Moonshot AI | 6.5 | 5.7 | $0.233 | 1/2 | 1.64s |
| #94 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 7.8 | $0.236 | 2/2 | 7.26s |
| #119 | Gemini 3.8 Flash low | 10.0 | 7.5 | $0.239 | 2/2 | 2.79s | |
| #72 | GPT-5 Mini medium | OpenAI | 10.0 | 8.1 | $0.241 | 2/2 | 11.6s |
| #245 | Qwen3.5-122B-A10B none | Qwen | 6.3 | 5.7 | $0.247 | 1/2 | 513ms |
| #42 | Gemini 3.6 Flash low | 9.8 | 8.7 | $0.251 | 2/2 | 2.82s | |
| #130 | GLM 5.3 high | Z.ai | 9.8 | 7.3 | $0.262 | 2/2 | 3.62s |
| #89 | Gemini 3.5 Flash Lite medium | 9.8 | 7.8 | $0.272 | 2/2 | 1.72s | |
| #54 | DeepSeek V4.1 Flash medium | DeepSeek | 10.0 | 8.5 | $0.272 | 2/2 | 9.69s |
| #87 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.277 | 2/2 | 16.1s |
| #78 | DeepSeek V4 Flash 0731 high | DeepSeek | 9.8 | 8.0 | $0.279 | 2/2 | 4.46s |