Anweisungen nicht befolgt-Fehler
Sieh, bei welchen KI-Modellen Anweisungen nicht befolgt besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst.
140/140
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Anweisungen nicht befolgt-Anzahl | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #143 | Gemini 3.1 Flash Lite high | 3 | 5.6 | $2.044 | 10/18 | 62.0s | |
| #148 | Owl Alpha none | Openrouter | 3 | 5.6 | $0.000 | 7/21 | 9.88s |
| #183 | Trinity Large Preview none | Arcee AI | 3 | 4.8 | $0.008 | 4/21 | 2.98s |
| #187 | Qwen3 Coder Next medium | Qwen | 3 | 4.7 | $0.032 | 4/22 | 9.61s |
| #188 | Cobuddy medium | Baidu | 3 | 4.7 | $0.000 | 7/21 | 39.9s |
| #190 | MiniMax M2.5 medium | Minimax | 3 | 4.6 | $0.340 | 5/22 | 68.3s |
| #193 | Elephant Alpha none | Openrouter | 3 | 4.3 | $0.000 | 5/21 | 1.22s |
| #203 | Grok 4.1 Fast none | X AI | 3 | 3.8 | $0.008 | 3/19 | 1.62s |
| #13 | GPT-5.3-Codex medium | OpenAI | 2 | 8.9 | $0.920 | 16/22 | 17.0s |
| #16 | Muse Spark 1.1 medium | Meta | 2 | 8.6 | $1.357 | 15/22 | 25.0s |
| #18 | GPT-5.4 medium | OpenAI | 2 | 8.5 | $1.533 | 15/22 | 23.1s |
| #24 | Muse Spark 1.1 low | Meta | 2 | 8.3 | $0.647 | 13/22 | 11.5s |
| #27 | Muse Spark 1.1 high | Meta | 2 | 8.1 | $1.694 | 12/22 | 31.5s |
| #35 | Seed-2.0-Lite medium | Bytedance Seed | 2 | 7.9 | $0.234 | 14/22 | 48.5s |
| #45 | DeepSeek V4 Flash high | DeepSeek | 2 | 7.7 | $0.042 | 13/22 | 49.7s |