Agentenaufgaben-Ranking
Sieh, welche KI-Modelle bei Agentenaufgaben am besten abschneiden, welche zuverlässig bleiben und wo die größten Unterschiede liegen. Sortieren nach: Antwortzeit (Durchschnitt) ↓.
Angezeigte Modelle
15
Durchschnittlicher Wert für Agentenaufgaben-Score
5.8
Bestes Modell
MiniMax M2.5 3.0
380/380
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Agentenaufgaben-Score | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #215 | Gemini 3.1 Flash Lite Preview low | 5.0 | 6.3 | $0.736 | 0/1 | 71.3s | |
| #283 | Laguna XS 2.1 none | Poolside | 5.0 | 5.3 | $0.019 | 0/1 | 70.8s |
| #247 | Nemotron 3 Ultra none | NVIDIA | 5.0 | 5.9 | $0.193 | 0/1 | 70.2s |
| #5 | GPT-6 Astra max | OpenAI | 10.0 | 9.9 | $5.044 | 1/1 | 69.6s |
| #85 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 8.2 | $0.271 | 1/1 | 69.3s |
| #66 | Claude Sonnet 5 medium | Anthropic | 10.0 | 8.5 | $1.438 | 1/1 | 69.3s |
| #261 | Solar Pro 4 none | Upstage | 5.0 | 5.6 | $0.033 | 0/1 | 69.2s |
| #176 | Grok Build 0.1 medium | X AI | 3.4 | 6.7 | $1.419 | 0/1 | 69.0s |
| #23 | Claude Opus 5.5 low | Anthropic | 10.0 | 9.4 | $1.733 | 1/1 | 68.9s |
| #69 | GPT-5 Mini medium | OpenAI | 10.0 | 8.4 | $0.293 | 1/1 | 68.5s |
| #50 | GPT-5.4 medium | OpenAI | 10.0 | 8.8 | $2.006 | 1/1 | 67.8s |
| #169 | Qwen3.5-Flash medium | Qwen | 10.0 | 6.8 | $0.184 | 1/1 | 67.7s |
| #40 | Muse Spark 1.3 medium | Meta | 10.0 | 9.0 | $1.712 | 1/1 | 67.6s |
| #142 | Gemini 3.8 Flash low | 6.1 | 7.2 | $0.323 | 0/1 | 67.2s | |
| #59 | DeepSeek V4.1 Flash max | DeepSeek | 10.0 | 8.6 | $0.368 | 1/1 | 66.6s |