Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Custo total ↓.
Modelos exibidos
13
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Grok 4.20 Multi Agent Beta 9.8
343/343
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #288 | North Mini Code none | Cohere | 6.5 | 5.1 | $0.000 | 1/2 | 30.7s |
| #294 | Qwen3.6 Plus Preview medium | Qwen | 6.5 | 4.9 | $0.000 | 1/2 | 3.40s |
| #307 | Hunter Alpha medium | OpenRouter | 9.9 | 4.7 | $0.000 | 2/2 | 4.18s |
| #310 | Cobuddy medium | Baidu | 9.8 | 4.7 | $0.000 | 2/2 | 11.6s |
| #318 | Elephant Alpha none | Openrouter | 9.8 | 4.3 | $0.000 | 2/2 | 1.03s |
| #320 | Elephant Alpha medium | Openrouter | 9.8 | 4.3 | $0.000 | 2/2 | 987ms |
| #322 | Hunter Alpha none | OpenRouter | 6.4 | 4.2 | $0.000 | 1/2 | 2.82s |
| #327 | Ling 3.0 Tiny none | Inclusionai | 3.1 | 4.0 | $0.000 | 0/2 | 2.44s |
| #332 | Ling 3.0 Tiny high | Inclusionai | 6.8 | 3.8 | $0.000 | 1/2 | 3.10s |
| #333 | Ling 3.0 Tiny low | Inclusionai | 6.6 | 3.8 | $0.000 | 1/2 | 3.09s |
| #336 | Ling 3.0 Tiny medium | Inclusionai | 6.8 | 3.8 | $0.000 | 1/2 | 3.00s |
| #339 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 7.3 | 3.4 | $0.000 | 1/2 | 1.37s |
| #340 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 4.8 | 3.2 | $0.000 | 0/2 | 541ms |