API-Fehler-Fehler
Sieh, bei welchen KI-Modellen API-Fehler besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst. Sortieren nach: Fehleranzahl ↑.
Kategorien
In der Kategorie Programmierung56 In der Kategorie Kombiniert37 In der Kategorie Werkzeugaufrufe25 In der Kategorie Anti-KI-Tricks22 In der Kategorie Datenanalyse und -extraktion22 In der Kategorie Domänenspezifisch17 In der Kategorie Rätsellösen15 In der Kategorie Allgemeine Intelligenz14 In der Kategorie Allgemeinwissen14 In der Kategorie Befolgung von Anweisungen5
104/104
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | API-Fehler-Anzahl | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #269 | Laguna S 2.1 high | Poolside | 1 | 5.4 | $0.114 | 4/22 | 111.6s |
| #281 | Mistral Small 4 medium | Mistral | 1 | 5.1 | $0.097 | 5/22 | 10.8s |
| #284 | Mercury 2.5 low | Inception | 1 | 5.1 | $0.011 | 6/22 | 1.35s |
| #289 | MiniMax M2.7 medium | Minimax | 1 | 5.0 | $0.208 | 5/22 | 43.2s |
| #290 | Mercury 2.5 Preview low | Inception | 1 | 5.0 | $0.011 | 6/22 | 1.31s |
| #291 | Laguna S 2.1 low | Poolside | 1 | 5.0 | $0.082 | 3/22 | 85.3s |
| #304 | KAT-Coder-Air V2.5 none | Kwaipilot | 1 | 4.8 | $0.070 | 5/22 | 12.5s |
| #307 | Hunter Alpha medium | OpenRouter | 1 | 4.7 | $0.000 | 8/18 | 10.3s |
| #310 | Cobuddy medium | Baidu | 1 | 4.7 | $0.000 | 7/21 | 39.9s |
| #322 | Hunter Alpha none | OpenRouter | 1 | 4.2 | $0.000 | 6/18 | 4.70s |
| #326 | MiMo-V2-Flash none | Xiaomi | 1 | 4.0 | $0.025 | 4/21 | 2.76s |
| #327 | Ling 3.0 Tiny none | Inclusionai | 1 | 4.0 | $0.000 | 2/22 | 14.0s |
| #332 | Ling 3.0 Tiny high | Inclusionai | 1 | 3.8 | $0.000 | 4/22 | 75.7s |
| #333 | Ling 3.0 Tiny low | Inclusionai | 1 | 3.8 | $0.000 | 4/22 | 66.2s |
| #335 | Qwen3.5-9B medium | Qwen | 1 | 3.8 | $0.062 | 3/22 | 107.5s |