Keine Antwort-Fehler
Sieh, bei welchen KI-Modellen Keine Antwort besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst.
Kategorien
In der Kategorie Kombiniert29 In der Kategorie Programmierung18 In der Kategorie Allgemeinwissen12 In der Kategorie Domänenspezifisch8 In der Kategorie Datenanalyse und -extraktion5 In der Kategorie Anti-KI-Tricks4 In der Kategorie Rätsellösen3 In der Kategorie Befolgung von Anweisungen2 In der Kategorie Werkzeugaufrufe2
64/64
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Keine Antwort-Anzahl | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #85 | Step 3.7 Flash high | Stepfun | 4 | 6.9 | $1.207 | 11/22 | 64.7s |
| #96 | Qwen3.6 27B medium | Qwen | 3 | 6.5 | $0.779 | 10/22 | 106.3s |
| #190 | GLM 4.7 Flash medium | Z.ai | 3 | 4.3 | $0.166 | 4/22 | 142.6s |
| #12 | Grok 4.5 high | X AI | 2 | 8.9 | $1.707 | 17/22 | 76.5s |
| #17 | Claude Fable 5 medium | Anthropic | 2 | 8.6 | $3.478 | 17/22 | 17.2s |
| #38 | GLM 5.2 medium | Z.ai | 2 | 7.8 | $0.068 | 15/21 | 23.3s |
| #76 | Kimi K2.5 medium | Moonshot AI | 2 | 7.0 | $0.600 | 10/22 | 99.0s |
| #93 | Gemma 4 26B A4B medium | 2 | 6.6 | $0.082 | 14/22 | 103.8s | |
| #108 | Claude Sonnet 5 none | Anthropic | 2 | 6.3 | $0.548 | 8/22 | 6.04s |
| #115 | Qwen3.5-35B-A3B medium | Qwen | 2 | 6.2 | $0.837 | 11/22 | 112.5s |
| #130 | Mimo V2 Omni medium | Xiaomi | 2 | 5.9 | $0.683 | 10/21 | 41.2s |
| #168 | MiniMax M2.7 medium | Minimax | 2 | 5.0 | $0.163 | 5/22 | 41.3s |
| #186 | MiniMax M2.5 medium | Minimax | 2 | 4.6 | $0.340 | 5/22 | 68.3s |
| #194 | Laguna Xs.2 medium | Poolside | 2 | 4.1 | $0.015 | 6/19 | 6.73s |
| #200 | Qwen3.5-9B medium | Qwen | 2 | 3.8 | $0.036 | 3/22 | 82.2s |