Keine Antwort-Fehler
Sieh, bei welchen KI-Modellen Keine Antwort besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst. Sortieren nach: Korrekte Tests ↓.
Kategorien
In der Kategorie Kombiniert43 In der Kategorie Programmierung39 In der Kategorie Domänenspezifisch35 In der Kategorie Allgemeinwissen27 In der Kategorie Anti-KI-Tricks13 In der Kategorie Rätsellösen11 In der Kategorie Datenanalyse und -extraktion9 In der Kategorie Befolgung von Anweisungen2 In der Kategorie Werkzeugaufrufe2
119/119
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Keine Antwort-Anzahl | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #254 | Granite 4.2 8B medium | IBM Granite | 1 | 5.2 | $0.009 | 7/22 | 46.0s |
| #258 | Granite 4.2 8B low | IBM Granite | 1 | 5.1 | $0.012 | 7/22 | 54.4s |
| #299 | Laguna Xs.2 medium | Poolside | 2 | 4.1 | $0.015 | 6/19 | 6.73s |
| #222 | Kimi K2.6 none | Moonshot AI | 1 | 5.7 | $0.233 | 6/22 | 19.6s |
| #248 | Seed-2.0-Code none | Bytedance Seed | 1 | 5.3 | $0.151 | 6/22 | 14.7s |
| #265 | Mercury 2.5 Preview low | Inception | 1 | 5.0 | $0.011 | 6/22 | 1.31s |
| #242 | MiMo-V2.5-Pro none | Xiaomi | 1 | 5.4 | $0.068 | 5/22 | 4.24s |
| #243 | Kimi K2.5 none | Moonshot AI | 1 | 5.4 | $0.101 | 5/22 | 18.0s |
| #257 | Mistral Small 4 medium | Mistral | 1 | 5.1 | $0.097 | 5/22 | 10.8s |
| #259 | Qwen3 Coder Next none | Qwen | 1 | 5.1 | $0.026 | 5/22 | 8.63s |
| #260 | MiMo-V2.5 none | Xiaomi | 1 | 5.1 | $0.025 | 5/22 | 4.68s |
| #264 | MiniMax M2.7 medium | Minimax | 2 | 5.0 | $0.208 | 5/22 | 43.2s |
| #268 | GPT-4o-mini none | OpenAI | 1 | 5.0 | $0.010 | 5/22 | 1.92s |
| #277 | Trinity Large Thinking high | Arcee AI | 1 | 4.8 | $0.592 | 5/22 | 75.9s |
| #289 | MiniMax M2.5 medium | Minimax | 2 | 4.6 | $0.327 | 5/22 | 69.1s |