Anti-KI-Tricks: Falsche Antwort
Anti-KI-Tricks
Falsche Antwort
Sieh, welche KI-Modelle bei Anti-KI-Tricks am ehesten auf Falsche Antwort stoßen, damit du Schwachstellen schneller erkennst.
Fehlergründe
188/188
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Falsche Antwort-Anzahl | Kategorie-Score | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #30 | GPT-5.3-Codex medium | OpenAI | 1 | 8.7 | $0.988 | 3/4 | 4.16s |
| #32 | Seed 2.1 Turbo high | Bytedance Seed | 1 | 8.2 | $1.797 | 3/4 | 47.0s |
| #38 | Gemini 3.6 Flash low | 1 | 8.7 | $0.251 | 3/4 | 1.85s | |
| #40 | Claude Opus 4.7 medium | Anthropic | 1 | 8.3 | $1.476 | 3/4 | 1.85s |
| #47 | GPT-5.4 medium | OpenAI | 1 | 8.3 | $1.560 | 3/4 | 4.11s |
| #52 | GPT-5.2 medium | OpenAI | 1 | 6.5 | $1.182 | 2/4 | 7.81s |
| #54 | Seed 2.1 Turbo medium | Bytedance Seed | 1 | 8.2 | $1.951 | 3/4 | 28.2s |
| #58 | Gemini 2.5 Flash medium | 1 | 8.4 | $0.644 | 3/4 | 6.30s | |
| #62 | GPT-5 Mini medium | OpenAI | 1 | 7.1 | $0.241 | 2/4 | 13.9s |
| #65 | Muse Spark 1.1 high | Meta | 1 | 7.5 | $2.253 | 2/4 | 8.60s |
| #66 | DeepSeek V4 Flash 0731 low | DeepSeek | 1 | 8.2 | $0.044 | 3/4 | 10.1s |
| #67 | DeepSeek V4 Flash 0731 high | DeepSeek | 1 | 8.7 | $0.084 | 3/4 | 13.6s |
| #70 | GPT-5.6 Terra high | OpenAI | 1 | 8.3 | $0.836 | 3/4 | 2.54s |
| #72 | GPT-5.2 Chat none | OpenAI | 1 | 8.7 | $0.594 | 3/4 | 3.40s |
| #79 | GPT-5.6 Terra medium | OpenAI | 1 | 8.3 | $0.523 | 3/4 | 2.22s |