Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Custo total ↓.
Modelos exibidos
15
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Grok 4.20 Multi Agent Beta 9.8
343/343
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #225 | Gemini 3 PRO Preview medium | 9.8 | 6.0 | $0.385 | 2/2 | 3.26s | |
| #80 | Inkling medium | Thinkingmachines | 9.8 | 8.0 | $0.383 | 2/2 | 6.17s |
| #8 | GPT-5.6 Sol low | OpenAI | 10.0 | 9.5 | $0.357 | 2/2 | 2.27s |
| #201 | Mimo V2 PRO medium | Xiaomi | 9.9 | 6.3 | $0.333 | 2/2 | 3.36s |
| #314 | MiniMax M2.5 medium | Minimax | 7.5 | 4.6 | $0.327 | 1/2 | 621ms |
| #103 | GLM 5 Turbo medium | Z.ai | 10.0 | 7.6 | $0.323 | 2/2 | 5.38s |
| #140 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 10.0 | 7.2 | $0.323 | 2/2 | 20.2s |
| #12 | Gemini 3.7 Flash medium | 10.0 | 9.4 | $0.309 | 2/2 | 2.81s | |
| #112 | MiniMax M3 medium | Minimax | 9.8 | 7.5 | $0.300 | 2/2 | 6.14s |
| #177 | Gemini 3.5 Flash minimal | 6.4 | 6.7 | $0.300 | 1/2 | 893ms | |
| #53 | DeepSeek V4.1 Flash high | DeepSeek | 10.0 | 8.5 | $0.287 | 2/2 | 7.06s |
| #60 | Qwen3.8 27B high | Qwen | 9.8 | 8.4 | ~$0.287 | 2/2 | 8.24s |
| #224 | GPT-5.6 Terra none | OpenAI | 8.5 | 6.0 | $0.280 | 1/2 | 1.15s |
| #78 | DeepSeek V4 Flash 0731 high | DeepSeek | 9.8 | 8.0 | $0.279 | 2/2 | 4.46s |
| #87 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.277 | 2/2 | 16.1s |