API-Fehler-Fehler
Sieh, bei welchen KI-Modellen API-Fehler besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst. Sortieren nach: Fehleranzahl ↑.
Kategorien
In der Kategorie Programmierung45 In der Kategorie Kombiniert26 In der Kategorie Werkzeugaufrufe17 In der Kategorie Anti-KI-Tricks14 In der Kategorie Datenanalyse und -extraktion14 In der Kategorie Allgemeinwissen13 In der Kategorie Allgemeine Intelligenz12 In der Kategorie Rätsellösen12 In der Kategorie Domänenspezifisch7 In der Kategorie Befolgung von Anweisungen1
68/68
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | API-Fehler-Anzahl | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #209 | Step 3.5 Flash none | Stepfun | 4 | 2.3 | $0.020 | 6/12 | 39.0s |
| #210 | LFM2-24B-A2B none | Liquid | 4 | 2.2 | $0.001 | 2/16 | 782ms |
| #179 | Ring-2.6-1T none | Inclusionai | 6 | 4.8 | $0.026 | 9/22 | 55.1s |
| #207 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 6 | 3.4 | $0.000 | 4/19 | 17.1s |
| #208 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 6 | 3.2 | $0.000 | 2/19 | 728ms |
| #135 | Hy3 preview high | Tencent | 7 | 5.9 | $0.048 | 11/21 | 56.6s |
| #153 | Hy3 preview low | Tencent | 7 | 5.5 | $0.015 | 10/21 | 24.6s |
| #175 | Qwen3.6 Plus Preview medium | Qwen | 8 | 4.9 | $0.000 | 9/19 | 15.2s |