API-Fehler-Fehler
Sieh, bei welchen KI-Modellen API-Fehler besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst.
Kategorien
In der Kategorie Programmierung44 In der Kategorie Kombiniert25 In der Kategorie Werkzeugaufrufe17 In der Kategorie Anti-KI-Tricks14 In der Kategorie Datenanalyse und -extraktion14 In der Kategorie Allgemeinwissen13 In der Kategorie Allgemeine Intelligenz12 In der Kategorie Rätsellösen12 In der Kategorie Domänenspezifisch7 In der Kategorie Befolgung von Anweisungen1
66/66
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | API-Fehler-Anzahl | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #171 | Qwen3.6 Plus Preview medium | Qwen | 8 | 4.9 | $0.000 | 9/19 | 15.2s |
| #131 | Hy3 preview high | Tencent | 7 | 5.9 | $0.048 | 11/21 | 56.6s |
| #149 | Hy3 preview low | Tencent | 7 | 5.5 | $0.015 | 10/21 | 24.6s |
| #175 | Ring-2.6-1T none | Inclusionai | 6 | 4.8 | $0.026 | 9/22 | 55.1s |
| #203 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 6 | 3.4 | $0.000 | 4/19 | 17.1s |
| #204 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 6 | 3.2 | $0.000 | 2/19 | 728ms |
| #78 | Gemini 3.5 Flash none | 4 | 7.0 | $1.079 | 15/22 | 9.93s | |
| #129 | Gemini 3 PRO Preview medium | 4 | 6.0 | $0.385 | 14/21 | 9.05s | |
| #136 | Nemotron 3 Super medium | NVIDIA | 4 | 5.7 | $0.066 | 8/22 | 52.0s |
| #169 | DeepSeek V3.2 none | DeepSeek | 4 | 5.0 | $0.054 | 6/22 | 18.3s |
| #182 | Laguna M.1 medium | Poolside | 4 | 4.7 | $0.033 | 9/19 | 14.7s |
| #188 | Laguna M.1 none | Poolside | 4 | 4.4 | $0.009 | 4/19 | 2.89s |
| #194 | Laguna Xs.2 medium | Poolside | 4 | 4.1 | $0.015 | 6/19 | 6.73s |
| #195 | Hy3 preview none | Tencent | 4 | 4.0 | $0.003 | 4/21 | 12.9s |
| #201 | Laguna Xs.2 none | Poolside | 4 | 3.8 | $0.004 | 5/19 | 806ms |