Anti-KI-Tricks: Falsche Antwort
Anti-KI-Tricks
Falsche Antwort
Sieh, welche KI-Modelle bei Anti-KI-Tricks am ehesten auf Falsche Antwort stoßen, damit du Schwachstellen schneller erkennst.
Fehlergründe
188/188
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Falsche Antwort-Anzahl | Kategorie-Score | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #244 | Ling-2.6-1T none | Inclusionai | 4 | 3.4 | $0.016 | 0/4 | 6.55s |
| #246 | Qwen3.6 35B A3B none | Qwen | 4 | 3.6 | $0.051 | 0/4 | 2.10s |
| #251 | Mistral Small 4 none | Mistral | 4 | 3.4 | $0.022 | 0/4 | 395ms |
| #255 | MiMo-V2.5 none | Xiaomi | 4 | 3.5 | $0.025 | 0/4 | 2.19s |
| #256 | Qwen3.5-9B none | Qwen | 4 | 3.1 | $0.021 | 0/4 | 1.71s |
| #257 | GLM 5 Turbo none | Z.ai | 4 | 3.0 | $0.047 | 0/4 | 2.84s |
| #265 | Mercury 2.5 Preview none | Inception | 4 | 3.8 | $0.018 | 0/4 | 655ms |
| #271 | GPT-5.4 Nano none | OpenAI | 4 | 3.5 | $0.041 | 0/4 | 1.18s |
| #276 | Trinity Large Preview none | Arcee AI | 4 | 3.1 | $0.008 | 0/4 | 2.07s |
| #281 | Mercury 2 none | Inception | 4 | 3.0 | $0.030 | 0/4 | 483ms |
| #285 | Laguna S 2.1 none | Poolside | 4 | 3.1 | $0.022 | 0/4 | 835ms |
| #286 | Grok 4.20 Beta none | X AI | 4 | 4.0 | $0.087 | 0/4 | 597ms |
| #292 | Hunter Alpha none | OpenRouter | 4 | 3.5 | $0.000 | 0/4 | 3.81s |
| #296 | MiMo-V2-Flash none | Xiaomi | 4 | 3.2 | $0.025 | 0/4 | 1.19s |
| #89 | Claude Opus 5 none | Anthropic | 3 | 5.5 | $1.550 | 1/4 | 4.33s |