Keine Antwort-Fehler
Sieh, bei welchen KI-Modellen Keine Antwort besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst.
Kategorien
In der Kategorie Kombiniert29 In der Kategorie Programmierung18 In der Kategorie Allgemeinwissen13 In der Kategorie Datenanalyse und -extraktion8 In der Kategorie Domänenspezifisch8 In der Kategorie Anti-KI-Tricks4 In der Kategorie Rätsellösen3 In der Kategorie Befolgung von Anweisungen2 In der Kategorie Werkzeugaufrufe2
67/67
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Keine Antwort-Anzahl | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #204 | Qwen3.5-9B medium | Qwen | 2 | 3.8 | $0.036 | 3/22 | 82.2s |
| #14 | Claude Opus 4.8 medium | Anthropic | 1 | 8.8 | $1.931 | 18/22 | 12.5s |
| #21 | GPT-5.2 medium | OpenAI | 1 | 8.4 | $0.951 | 14/22 | 22.6s |
| #26 | GPT-5 Mini medium | OpenAI | 1 | 8.1 | $0.237 | 12/22 | 27.6s |
| #27 | Muse Spark 1.1 high | Meta | 1 | 8.1 | $1.694 | 12/22 | 31.5s |
| #29 | Step 3.7 Flash medium | Stepfun | 1 | 8.0 | $0.515 | 14/22 | 26.4s |
| #30 | GPT-5.2 Chat none | OpenAI | 1 | 8.0 | $0.604 | 14/22 | 7.65s |
| #31 | GLM 5.2 high | Z.ai | 1 | 8.0 | $0.970 | 14/22 | 62.7s |
| #32 | Inkling medium | Thinkingmachines | 1 | 8.0 | $0.391 | 15/22 | 16.2s |
| #33 | Kimi K3 max | Moonshot AI | 1 | 8.0 | $3.112 | 16/22 | 122.5s |
| #35 | Seed-2.0-Lite medium | Bytedance Seed | 1 | 7.9 | $0.234 | 14/22 | 48.5s |
| #41 | Claude Opus 4.8 low | Anthropic | 1 | 7.8 | $2.077 | 16/22 | 12.7s |
| #42 | GLM 5 medium | Z.ai | 1 | 7.7 | $0.307 | 15/21 | 33.5s |
| #46 | DeepSeek V4 Pro high | DeepSeek | 1 | 7.7 | $0.200 | 10/22 | 79.1s |
| #47 | MiniMax M3 medium | Minimax | 1 | 7.6 | $0.286 | 12/22 | 75.0s |