Befolgung von Anweisungen-Ranking
Sieh, welche KI-Modelle bei Befolgung von Anweisungen am besten abschneiden, welche zuverlässig bleiben und wo die größten Unterschiede liegen. Sortieren nach: Antwortzeit (Durchschnitt) ↓.
Angezeigte Modelle
15
Durchschnittlicher Wert für Befolgung von Anweisungen-Score
8.5
Bestes Modell
Kimi K2.5 10.0
210/210
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Befolgung von Anweisungen-Score | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #150 | DeepSeek V4 Flash none | DeepSeek | 6.5 | 5.6 | $0.044 | 1/2 | 17.5s |
| #95 | Gemma 4 26B A4B medium | 10.0 | 6.6 | $0.089 | 2/2 | 17.5s | |
| #80 | Seed-2.0-Mini medium | Bytedance Seed | 10.0 | 7.0 | $0.101 | 2/2 | 17.5s |
| #36 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.267 | 2/2 | 16.1s |
| #153 | Hy3 preview low | Tencent | 10.0 | 5.5 | $0.015 | 2/2 | 16.0s |
| #128 | GPT-5 Nano medium | OpenAI | 9.8 | 6.1 | $0.114 | 2/2 | 15.6s |
| #137 | North Mini Code medium | Cohere | 9.8 | 5.9 | $0.000 | 2/2 | 15.4s |
| #45 | DeepSeek V4 Flash high | DeepSeek | 10.0 | 7.7 | $0.042 | 2/2 | 15.4s |
| #199 | Hy3 preview none | Tencent | 6.3 | 4.0 | $0.003 | 1/2 | 13.0s |
| #172 | MiniMax M2.7 medium | Minimax | 3.8 | 5.0 | $0.163 | 0/2 | 12.8s |
| #110 | Gemma 4 31B medium | 10.0 | 6.3 | $0.163 | 2/2 | 12.8s | |
| #68 | Kimi K2.6 medium | Moonshot AI | 10.0 | 7.2 | $1.036 | 2/2 | 12.5s |
| #48 | Grok Build 0.1 medium | X AI | 9.8 | 7.6 | $1.097 | 2/2 | 12.4s |
| #108 | Ring-2.6-1T medium | Inclusionai | 9.8 | 6.3 | $0.103 | 2/2 | 11.8s |
| #188 | Cobuddy medium | Baidu | 9.8 | 4.7 | $0.000 | 2/2 | 11.6s |