Agentenaufgaben-Ranking
Sieh, welche KI-Modelle bei Agentenaufgaben am besten abschneiden, welche zuverlässig bleiben und wo die größten Unterschiede liegen. Sortieren nach: Korrekte Tests ↓.
Angezeigte Modelle
5
Durchschnittlicher Wert für Agentenaufgaben-Score
5.8
Bestes Modell
Gemini 3.6 Flash 10.0
380/380
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Agentenaufgaben-Score | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #375 | Jev 1.13 none | Typesafe | 0.0 | 2.6 | $0.003 | 0/0 | 0ms |
| #376 | Kev 4B none | Jaredpalmer | 0.0 | 2.4 | $0.002 | 0/0 | 0ms |
| #377 | Step 3.5 Flash none | Stepfun | 0.0 | 1.9 | $0.020 | 0/0 | 0ms |
| #379 | LFM2-24B-A2B none | Liquid | 0.0 | 1.8 | $0.001 | 0/0 | 0ms |
| #380 | Claude Opus 5.5 none | Anthropic | 0.0 | 1.5 | $0.015 | 0/0 | 0ms |