API-Fehler-Fehler
Sieh, bei welchen KI-Modellen API-Fehler besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst. Sortieren nach: Korrekte Tests ↑.
Kategorien
In der Kategorie Programmierung56 In der Kategorie Kombiniert37 In der Kategorie Werkzeugaufrufe25 In der Kategorie Anti-KI-Tricks22 In der Kategorie Datenanalyse und -extraktion22 In der Kategorie Domänenspezifisch17 In der Kategorie Rätsellösen15 In der Kategorie Allgemeine Intelligenz14 In der Kategorie Allgemeinwissen14 In der Kategorie Befolgung von Anweisungen5
104/104
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | API-Fehler-Anzahl | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #327 | Ling 3.0 Tiny none | Inclusionai | 1 | 4.0 | $0.000 | 2/22 | 14.0s |
| #340 | Nemotron 3 Nano Omni 30b A3b Reasoning none | NVIDIA | 6 | 3.2 | $0.000 | 2/19 | 728ms |
| #343 | LFM2-24B-A2B none | Liquid | 4 | 2.2 | $0.001 | 2/16 | 782ms |
| #255 | Hy4 preview low | Tencent | 14 | 5.6 | $1.745 | 3/22 | 214.3s |
| #291 | Laguna S 2.1 low | Poolside | 1 | 5.0 | $0.082 | 3/22 | 85.3s |
| #298 | Hy4 preview none | Tencent | 7 | 4.8 | $0.041 | 3/22 | 39.2s |
| #335 | Qwen3.5-9B medium | Qwen | 1 | 3.8 | $0.062 | 3/22 | 107.5s |
| #269 | Laguna S 2.1 high | Poolside | 1 | 5.4 | $0.114 | 4/22 | 111.6s |
| #273 | Ling-2.6-1T none | Inclusionai | 3 | 5.3 | $0.016 | 4/22 | 8.59s |
| #275 | Qwen3.6 35B A3B none | Qwen | 2 | 5.3 | $0.061 | 4/22 | 5.57s |
| #332 | Ling 3.0 Tiny high | Inclusionai | 1 | 3.8 | $0.000 | 4/22 | 75.7s |
| #333 | Ling 3.0 Tiny low | Inclusionai | 1 | 3.8 | $0.000 | 4/22 | 66.2s |
| #336 | Ling 3.0 Tiny medium | Inclusionai | 1 | 3.8 | $0.000 | 4/22 | 68.1s |
| #306 | Trinity Large Preview none | Arcee AI | 2 | 4.8 | $0.008 | 4/21 | 2.98s |
| #325 | Hy3 preview none | Tencent | 4 | 4.0 | $0.007 | 4/21 | 12.9s |