Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Testes corretos ↓.
Modelos exibidos
15
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Gemini 3.6 Flash 10.0
311/311
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #227 | Nemotron 3.5 Lightning high | NVIDIA | 8.5 | 5.6 | $0.134 | 1/2 | 4.98s |
| #229 | Qwen3.6 27B none | Qwen | 6.2 | 5.5 | $0.116 | 1/2 | 1.92s |
| #231 | Qwen3.8 27B none | Qwen | 6.3 | 5.5 | ~$0.006 | 1/2 | 582ms |
| #232 | Mimo V2 Omni none | Xiaomi | 6.5 | 5.5 | $0.021 | 1/2 | 4.26s |
| #233 | DeepSeek V4 Flash 0423 none | DeepSeek | 6.5 | 5.4 | $0.037 | 1/2 | 17.5s |
| #236 | GPT-5.6 Luna none | OpenAI | 7.1 | 5.4 | $0.029 | 1/2 | 1.23s |
| #237 | MiMo-V2.5-Pro none | Xiaomi | 6.4 | 5.4 | $0.068 | 1/2 | 1.03s |
| #238 | Kimi K2.5 none | Moonshot AI | 6.5 | 5.4 | $0.101 | 1/2 | 2.67s |
| #241 | Inkling Small none | Thinkingmachines | 6.3 | 5.3 | $0.054 | 1/2 | 767ms |
| #243 | Seed-2.0-Code none | Bytedance Seed | 6.2 | 5.3 | $0.151 | 1/2 | 1.80s |
| #244 | Ling-2.6-1T none | Inclusionai | 6.4 | 5.3 | $0.016 | 1/2 | 5.36s |
| #246 | Qwen3.6 35B A3B none | Qwen | 6.2 | 5.3 | $0.051 | 1/2 | 1.86s |
| #248 | Inkling none | Thinkingmachines | 6.3 | 5.2 | $0.147 | 1/2 | 1.72s |
| #250 | Nemotron 3.5 Lightning medium | NVIDIA | 8.5 | 5.1 | $0.156 | 1/2 | 3.75s |
| #251 | Mistral Small 4 none | Mistral | 6.5 | 5.1 | $0.022 | 1/2 | 380ms |