Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Custo total ↑.
Modelos exibidos
15
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Dots 3 Note Preview 7.9
343/343
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #181 | Gemini 3.5 Flash Lite low | 9.8 | 6.6 | $0.138 | 2/2 | 1.75s | |
| #146 | Solar Pro 4 high | Upstage | 7.9 | 7.1 | $0.138 | 1/2 | 41.5s |
| #77 | DeepSeek V4 Flash 0731 low | DeepSeek | 9.9 | 8.0 | $0.138 | 2/2 | 3.01s |
| #300 | Nemotron 3.5 Lightning low | NVIDIA | 8.4 | 4.8 | $0.139 | 1/2 | 5.46s |
| #167 | Solar Pro 4 medium | Upstage | 9.8 | 6.8 | $0.140 | 2/2 | 40.1s |
| #214 | Qwen3.5-Flash medium | Qwen | 10.0 | 6.1 | $0.142 | 2/2 | 63.5s |
| #109 | GPT-5.4 Nano medium | OpenAI | 9.8 | 7.5 | $0.142 | 2/2 | 1.88s |
| #277 | Inkling none | Thinkingmachines | 6.3 | 5.2 | $0.147 | 1/2 | 1.72s |
| #105 | Solar Pro 4 xhigh | Upstage | 8.4 | 7.6 | $0.150 | 1/2 | 51.3s |
| #272 | Seed-2.0-Code none | Bytedance Seed | 6.2 | 5.3 | $0.151 | 1/2 | 1.80s |
| #90 | GLM 5.2 medium | Z.ai | 9.9 | 7.8 | $0.151 | 2/2 | 7.90s |
| #228 | Qwen3.5-35B-A3B none | Qwen | 6.3 | 5.9 | $0.151 | 1/2 | 809ms |
| #144 | Muse Glimmer 30B low | Meta | 8.4 | 7.1 | $0.152 | 1/2 | 3.60s |
| #279 | Nemotron 3.5 Lightning medium | NVIDIA | 8.5 | 5.1 | $0.155 | 1/2 | 3.75s |
| #243 | GLM 5.1 none | Z.ai | 9.8 | 5.7 | $0.164 | 2/2 | 1.98s |