API-Fehler-Fehler
Sieh, bei welchen KI-Modellen API-Fehler besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst. Sortieren nach: Gesamtkosten ↑.
Kategorien
In der Kategorie Programmierung45 In der Kategorie Kombiniert26 In der Kategorie Werkzeugaufrufe17 In der Kategorie Anti-KI-Tricks14 In der Kategorie Datenanalyse und -extraktion14 In der Kategorie Allgemeinwissen13 In der Kategorie Allgemeine Intelligenz12 In der Kategorie Rätsellösen12 In der Kategorie Domänenspezifisch7 In der Kategorie Befolgung von Anweisungen1
68/68
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | API-Fehler-Anzahl | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #90 | Qwen3.6 35B A3B medium | Qwen | 2 | 6.7 | $0.746 | 13/22 | 58.1s |
| #52 | Kimi K2.7 Code medium | Moonshot AI | 1 | 7.5 | $0.751 | 12/22 | 84.2s |
| #51 | Nemotron 3 Ultra medium | NVIDIA | 1 | 7.5 | $0.774 | 13/22 | 32.2s |
| #119 | Qwen3.5-35B-A3B medium | Qwen | 1 | 6.2 | $0.837 | 11/22 | 112.5s |
| #79 | Gemini 3.5 Flash none | 4 | 7.0 | $1.079 | 15/22 | 9.93s | |
| #27 | Muse Spark 1.1 high | Meta | 1 | 8.1 | $1.694 | 12/22 | 31.5s |
| #33 | Kimi K3 max | Moonshot AI | 2 | 8.0 | $3.112 | 16/22 | 122.5s |
| #181 | Grok 4.20 Multi Agent Beta medium | X AI | 2 | 4.8 | $5.599 | 8/18 | 9.69s |