API-Fehler-Fehler
Sieh, bei welchen KI-Modellen API-Fehler besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst.
Kategorien
In der Kategorie Programmierung56 In der Kategorie Kombiniert37 In der Kategorie Werkzeugaufrufe25 In der Kategorie Anti-KI-Tricks20 In der Kategorie Datenanalyse und -extraktion17 In der Kategorie Domänenspezifisch17 In der Kategorie Rätsellösen15 In der Kategorie Allgemeine Intelligenz14 In der Kategorie Allgemeinwissen14 In der Kategorie Befolgung von Anweisungen2
94/94
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | API-Fehler-Anzahl | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #222 | Owl Alpha medium | Openrouter | 1 | 5.6 | $0.000 | 8/21 | 11.9s |
| #224 | Mimo V2 PRO none | Xiaomi | 1 | 5.6 | $0.045 | 7/21 | 2.27s |
| #226 | KAT-Coder-Air V2.5 medium | Kwaipilot | 1 | 5.6 | $0.048 | 8/22 | 8.65s |
| #232 | Mimo V2 Omni none | Xiaomi | 1 | 5.5 | $0.021 | 8/21 | 2.44s |
| #240 | Laguna S 2.1 high | Poolside | 1 | 5.4 | $0.114 | 4/22 | 111.6s |
| #252 | Mistral Small 4 medium | Mistral | 1 | 5.1 | $0.097 | 5/22 | 10.8s |
| #259 | MiniMax M2.7 medium | Minimax | 1 | 5.0 | $0.208 | 5/22 | 43.2s |
| #260 | Mercury 2.5 Preview low | Inception | 1 | 5.0 | $0.011 | 6/22 | 1.31s |
| #261 | Laguna S 2.1 low | Poolside | 1 | 5.0 | $0.082 | 3/22 | 85.3s |
| #274 | KAT-Coder-Air V2.5 none | Kwaipilot | 1 | 4.8 | $0.070 | 5/22 | 12.5s |
| #277 | Hunter Alpha medium | OpenRouter | 1 | 4.7 | $0.000 | 8/18 | 10.3s |
| #280 | Cobuddy medium | Baidu | 1 | 4.7 | $0.000 | 7/21 | 39.9s |
| #292 | Hunter Alpha none | OpenRouter | 1 | 4.2 | $0.000 | 6/18 | 4.70s |
| #296 | MiMo-V2-Flash none | Xiaomi | 1 | 4.0 | $0.025 | 4/21 | 2.76s |
| #297 | Ling 3.0 Tiny none | Inclusionai | 1 | 4.0 | $0.000 | 2/22 | 14.0s |