Befolgung von Anweisungen-Ranking
Sieh, welche KI-Modelle bei Befolgung von Anweisungen am besten abschneiden, welche zuverlässig bleiben und wo die größten Unterschiede liegen.
Angezeigte Modelle
11
Durchschnittlicher Wert für Befolgung von Anweisungen-Score
8.5
Bestes Modell
Gemini 3.6 Flash 10.0
311/311
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Befolgung von Anweisungen-Score | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #261 | Laguna S 2.1 low | Poolside | 4.3 | 5.0 | $0.082 | 0/2 | 423ms |
| #234 | Laguna S 2.1 medium | Poolside | 4.2 | 5.4 | $0.053 | 0/2 | 400ms |
| #242 | Laguna XS 2.1 none | Poolside | 3.8 | 5.3 | $0.008 | 0/2 | 364ms |
| #259 | MiniMax M2.7 medium | Minimax | 3.8 | 5.0 | $0.208 | 0/2 | 12.8s |
| #249 | Granite 4.2 8B medium | IBM Granite | 3.8 | 5.2 | $0.009 | 0/2 | 36.9s |
| #298 | Granite 4.1 8B none | IBM Granite | 3.6 | 4.0 | $0.007 | 0/2 | 344ms |
| #276 | Trinity Large Preview none | Arcee AI | 3.5 | 4.8 | $0.008 | 0/2 | 822ms |
| #297 | Ling 3.0 Tiny none | Inclusionai | 3.1 | 4.0 | $0.000 | 0/2 | 2.44s |
| #253 | Granite 4.2 8B low | IBM Granite | 3.0 | 5.1 | $0.012 | 0/2 | 75.8s |
| #291 | Granite 4.2 8B none | IBM Granite | 3.0 | 4.3 | $0.026 | 0/2 | 79.5s |
| #303 | Grok 4.1 Fast none | X AI | 3.0 | 3.8 | $0.008 | 0/2 | 685ms |