Rätsellösen: Anweisungen nicht befolgt
Rätsellösen
Anweisungen nicht befolgt
Sieh, welche KI-Modelle bei Rätsellösen am ehesten auf Anweisungen nicht befolgt stoßen, damit du Schwachstellen schneller erkennst.
Fehlergründe
86/86
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Anweisungen nicht befolgt-Anzahl | Kategorie-Score | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #187 | Qwen3 Coder Next medium | Qwen | 1 | 3.0 | $0.032 | 0/3 | 1.25s |
| #188 | Cobuddy medium | Baidu | 1 | 3.6 | $0.000 | 0/3 | 12.8s |
| #193 | Elephant Alpha none | Openrouter | 1 | 4.2 | $0.000 | 0/3 | 807ms |
| #194 | GLM 4.7 Flash medium | Z.ai | 1 | 2.9 | $0.166 | 0/3 | 12.9s |
| #195 | Elephant Alpha medium | Openrouter | 1 | 5.3 | $0.000 | 1/3 | 868ms |
| #196 | Hunter Alpha none | OpenRouter | 1 | 5.8 | $0.000 | 1/3 | 3.71s |
| #199 | Hy3 preview none | Tencent | 1 | 3.1 | $0.003 | 0/3 | 4.56s |
| #201 | Granite 4.1 8B none | IBM Granite | 1 | 3.2 | $0.007 | 0/3 | 608ms |
| #202 | Grok Build 0.1 none | X AI | 1 | 6.4 | $0.547 | 1/3 | 9.55s |
| #206 | gpt-oss-120b none | OpenAI | 1 | 6.0 | $0.010 | 1/3 | 8.21s |
| #208 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 1 | 3.0 | $0.000 | 0/3 | 532ms |