Ranking de Tareas de agentes
Mira qué modelos de IA rinden mejor en Tareas de agentes, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Costo total ↑.
Modelos mostrados
5
Promedio de Puntuación de Tareas de agentes
5.8
Mejor modelo
Space Bunny Alpha 10.0
380/380
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Tareas de agentes | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #5 | GPT-6 Astra max | OpenAI | 10.0 | 9.9 | $5.044 | 1/1 | 69.6s |
| #45 | Claude Fable 5 medium | Anthropic | 10.0 | 8.9 | $5.089 | 1/1 | 57.1s |
| #347 | Grok 4.20 Multi Agent Beta medium | X AI | 0.0 | 3.9 | $5.599 | 0/0 | 0ms |
| #8 | GPT-6 Astra xhigh | OpenAI | 10.0 | 9.9 | $6.213 | 1/1 | 56.7s |
| #29 | Claude Sonnet 5.5 max | Anthropic | 10.0 | 9.2 | $8.557 | 1/1 | 111.1s |