Ranking de Programação
Veja quais modelos de IA vão melhor em Programação, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Custo total ↓.
Modelos exibidos
4
Média de Pontuação de Programação
6.1
Melhor modelo
Grok 4.20 Multi Agent Beta 3.3
289/289
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Programação | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #280 | Ling 3.0 Tiny low | Inclusionai | 2.9 | 3.8 | $0.000 | 0/3 | 170.7s |
| #283 | Ling 3.0 Tiny medium | Inclusionai | 2.9 | 3.8 | $0.000 | 0/3 | 212.0s |
| #286 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 1.1 | 3.4 | $0.000 | 0/1 | 38.1s |
| #287 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 3.3 | 3.2 | $0.000 | 1/1 | 1.27s |