Rätsellösen: Anweisungen nicht befolgt
Rätsellösen
Anweisungen nicht befolgt
Sieh, welche KI-Modelle bei Rätsellösen am ehesten auf Anweisungen nicht befolgt stoßen, damit du Schwachstellen schneller erkennst.
Fehlergründe
121/121
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Anweisungen nicht befolgt-Anzahl | Kategorie-Score | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #185 | Qwen3.7 Flash none | Qwen | 1 | 3.7 | $0.019 | 0/3 | 1.39s |
| #186 | Gemini 3.1 Flash Lite none | 1 | 6.3 | $0.046 | 1/3 | 720ms | |
| #188 | Inkling low | Thinkingmachines | 1 | 6.4 | $0.187 | 1/3 | 2.97s |
| #190 | Qwen3.6 Flash none | Qwen | 1 | 3.5 | $0.062 | 0/3 | 1.21s |
| #191 | Gemma 4 31B none | 1 | 6.5 | $0.016 | 1/3 | 4.23s | |
| #193 | Nemotron 3 Ultra none | NVIDIA | 1 | 5.9 | $0.084 | 1/3 | 1.06s |
| #194 | Trinity Large Thinking low | Arcee AI | 1 | 6.3 | $0.625 | 1/3 | 3.28s |
| #199 | GPT-5 Nano medium | OpenAI | 1 | 5.3 | $0.118 | 1/3 | 20.6s |
| #201 | Qwen3.5-35B-A3B none | Qwen | 1 | 3.7 | $0.142 | 0/3 | 1.35s |
| #202 | Step 3.5 Flash medium | Stepfun | 1 | 5.3 | $0.132 | 1/3 | 7.22s |
| #203 | Dots 3 Note Preview medium | Dots Studio | 1 | 5.3 | $0.000 | 1/3 | 8.71s |
| #204 | Mimo V2 Omni medium | Xiaomi | 1 | 5.9 | $0.683 | 1/3 | 2.38s |
| #206 | GLM 5.3 Flash low | Z.ai | 1 | 7.8 | $0.015 | 2/3 | 2.67s |
| #207 | GPT-5.4 Mini none | OpenAI | 1 | 5.4 | $0.095 | 1/3 | 836ms |
| #209 | GPT-5.4 none | OpenAI | 1 | 5.6 | $0.397 | 1/3 | 1.44s |