API-Fehler-Fehler
Sieh, bei welchen KI-Modellen API-Fehler besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst. Sortieren nach: Korrekte Tests ↑.
Angezeigte Modelle
8
Gesamtfehler
161
Am stärksten betroffenes Modell
Nemotron 3 Nano Omni 30b A3b Reasoning 6Kategorien
In der Kategorie Programmierung45 In der Kategorie Kombiniert26 In der Kategorie Werkzeugaufrufe17 In der Kategorie Anti-KI-Tricks14 In der Kategorie Datenanalyse und -extraktion14 In der Kategorie Allgemeinwissen13 In der Kategorie Allgemeine Intelligenz12 In der Kategorie Rätsellösen12 In der Kategorie Domänenspezifisch7 In der Kategorie Befolgung von Anweisungen1
68/68
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | API-Fehler-Anzahl | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #57 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 1 | 7.5 | $0.437 | 14/22 | 89.2s |
| #110 | Gemma 4 31B medium | 2 | 6.3 | $0.163 | 14/22 | 75.4s | |
| #100 | Hy3 preview medium | Tencent | 3 | 6.5 | $0.018 | 14/21 | 16.3s |
| #133 | Gemini 3 PRO Preview medium | 4 | 6.0 | $0.385 | 14/21 | 9.05s | |
| #32 | Inkling medium | Thinkingmachines | 1 | 8.0 | $0.391 | 15/22 | 16.2s |
| #37 | Qwen3.6 Plus medium | Qwen | 1 | 7.8 | $0.405 | 15/22 | 43.1s |
| #79 | Gemini 3.5 Flash none | 4 | 7.0 | $1.079 | 15/22 | 9.93s | |
| #33 | Kimi K3 max | Moonshot AI | 2 | 8.0 | $3.112 | 16/22 | 122.5s |