Anti-KI-Tricks: Falsche Antwort
Anti-KI-Tricks
Falsche Antwort
Sieh, welche KI-Modelle bei Anti-KI-Tricks am ehesten auf Falsche Antwort stoßen, damit du Schwachstellen schneller erkennst.
Fehlergründe
188/188
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Falsche Antwort-Anzahl | Kategorie-Score | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #80 | Claude Sonnet 4.6 medium | Anthropic | 1 | 6.5 | $2.126 | 2/4 | 2.98s |
| #82 | Seed-2.0-Lite medium | Bytedance Seed | 1 | 8.3 | $0.236 | 3/4 | 18.0s |
| #86 | Seed-2.0-Code low | Bytedance Seed | 1 | 8.7 | $0.767 | 3/4 | 39.6s |
| #89 | DeepSeek V4 Flash 0423 high | DeepSeek | 1 | 8.3 | $0.042 | 3/4 | 28.5s |
| #91 | GPT-5.6 Luna high | OpenAI | 1 | 8.3 | $0.179 | 3/4 | 2.99s |
| #95 | GPT-5.4 Nano medium | OpenAI | 1 | 8.3 | $0.142 | 3/4 | 4.52s |
| #96 | GPT-5.6 Terra low | OpenAI | 1 | 8.3 | $0.420 | 3/4 | 2.36s |
| #98 | GPT 5.3 Chat none | OpenAI | 1 | 6.7 | $0.533 | 2/4 | 3.86s |
| #99 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 1 | 8.2 | $0.459 | 3/4 | 45.8s |
| #102 | GPT-5.4 Mini medium | OpenAI | 1 | 8.6 | $0.786 | 3/4 | 4.05s |
| #108 | GPT-5.6 Luna medium | OpenAI | 1 | 8.3 | $0.072 | 3/4 | 2.52s |
| #113 | Claude Sonnet 4.6 none | Anthropic | 1 | 4.8 | $0.661 | 1/4 | 2.94s |
| #116 | GLM 5.3 Flash high | Z.ai | 1 | 8.3 | $0.029 | 3/4 | 2.50s |
| #119 | DeepSeek V4 Flash 0731 medium | DeepSeek | 1 | 8.2 | $0.066 | 3/4 | 18.0s |
| #121 | Kimi K2.6 medium | Moonshot AI | 1 | 7.0 | $1.247 | 2/4 | 11.6s |