Ranking de Seguimento de instruções
Veja quais modelos de IA vão melhor em Seguimento de instruções, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Custo total ↑.
Modelos exibidos
15
Média de Pontuação de Seguimento de instruções
8.5
Melhor modelo
Dots 3 Note Preview 7.9
343/343
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Seguimento de instruções | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #332 | Ling 3.0 Tiny high | Inclusionai | 6.8 | 3.8 | $0.000 | 1/2 | 3.10s |
| #333 | Ling 3.0 Tiny low | Inclusionai | 6.6 | 3.8 | $0.000 | 1/2 | 3.09s |
| #336 | Ling 3.0 Tiny medium | Inclusionai | 6.8 | 3.8 | $0.000 | 1/2 | 3.00s |
| #339 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 7.3 | 3.4 | $0.000 | 1/2 | 1.37s |
| #340 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 4.8 | 3.2 | $0.000 | 0/2 | 541ms |
| #343 | LFM2-24B-A2B none | Liquid | 6.3 | 2.2 | $0.001 | 1/2 | 752ms |
| #296 | Ling-2.6-flash none | Inclusionai | 9.8 | 4.9 | $0.002 | 2/2 | 5.52s |
| #341 | Jev 1.13 none | Typesafe | 1.5 | 3.2 | $0.003 | 0/1 | 557ms |
| #242 | Ling-3.0-flash none | Inclusionai | 4.8 | 5.7 | $0.004 | 0/2 | 836ms |
| #337 | Laguna Xs.2 none | Poolside | 6.5 | 3.8 | $0.004 | 1/2 | 439ms |
| #258 | Qwen3.8 27B none | Qwen | 6.3 | 5.5 | ~$0.006 | 1/2 | 582ms |
| #329 | Nemotron 3.5 Lightning none | NVIDIA | 6.5 | 4.0 | $0.006 | 1/2 | 511ms |
| #328 | Granite 4.1 8B none | IBM Granite | 3.6 | 4.0 | $0.007 | 0/2 | 344ms |
| #325 | Hy3 preview none | Tencent | 6.3 | 4.0 | $0.007 | 1/2 | 13.0s |
| #271 | Laguna XS 2.1 none | Poolside | 3.8 | 5.3 | $0.008 | 0/2 | 364ms |