Ranking de Tarefas de agentes
Veja quais modelos de IA vão melhor em Tarefas de agentes, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Custo total ↓.
Modelos exibidos
5
Média de Pontuação de Tarefas de agentes
5.8
Melhor modelo
Claude Sonnet 5.5 10.0
380/380
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Tarefas de agentes | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #360 | Elephant Alpha medium | Openrouter | 0.0 | 3.5 | $0.000 | 0/0 | 0ms |
| #361 | Hunter Alpha none | OpenRouter | 0.0 | 3.5 | $0.000 | 0/0 | 0ms |
| #371 | Command A+ none | Cohere | 3.0 | 3.0 | $0.000 | 0/1 | 1.05s |
| #373 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 0.0 | 2.7 | $0.000 | 0/0 | 0ms |
| #374 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 0.0 | 2.6 | $0.000 | 0/0 | 0ms |