Anti-KI-Tricks: Falsche Antwort
Anti-KI-Tricks
Falsche Antwort
Sieh, welche KI-Modelle bei Anti-KI-Tricks am ehesten auf Falsche Antwort stoßen, damit du Schwachstellen schneller erkennst.
Fehlergründe
188/188
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Falsche Antwort-Anzahl | Kategorie-Score | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #259 | Qwen3 Coder Next none | Qwen | 2 | 3.6 | $0.026 | 0/4 | 3.31s |
| #263 | North Mini Code none | Cohere | 2 | 3.0 | $0.000 | 0/4 | 22.5s |
| #265 | Mercury 2.5 Preview low | Inception | 2 | 5.6 | $0.011 | 1/4 | 759ms |
| #275 | Nemotron 3.5 Lightning low | NVIDIA | 2 | 6.9 | $0.140 | 2/4 | 14.8s |
| #277 | Trinity Large Thinking high | Arcee AI | 2 | 6.7 | $0.592 | 2/4 | 4.13s |
| #282 | Hunter Alpha medium | OpenRouter | 2 | 7.3 | $0.000 | 2/4 | 4.75s |
| #294 | GLM 4.7 Flash medium | Z.ai | 2 | 4.7 | $0.168 | 1/4 | 15.0s |
| #295 | Elephant Alpha medium | Openrouter | 2 | 6.6 | $0.000 | 2/4 | 1.19s |
| #302 | Ling 3.0 Tiny none | Inclusionai | 2 | 4.8 | $0.000 | 1/4 | 5.14s |
| #303 | Granite 4.1 8B none | IBM Granite | 2 | 4.9 | $0.007 | 1/4 | 844ms |
| #311 | Laguna Xs.2 none | Poolside | 2 | 3.0 | $0.004 | 0/4 | 534ms |
| #314 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 2 | 4.8 | $0.000 | 1/4 | 584ms |
| #8 | GPT-5.6 Sol low | OpenAI | 1 | 8.3 | $0.357 | 3/4 | 2.60s |
| #15 | GPT-5.6 Sol high | OpenAI | 1 | 8.7 | $0.446 | 3/4 | 3.39s |
| #23 | Seed 2.1 Turbo low | Bytedance Seed | 1 | 8.2 | $1.546 | 3/4 | 34.8s |