API-Fehler-Fehler
Sieh, bei welchen KI-Modellen API-Fehler besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst. Sortieren nach: Gesamtkosten ↓.
Kategorien
In der Kategorie Programmierung56 In der Kategorie Kombiniert37 In der Kategorie Werkzeugaufrufe25 In der Kategorie Anti-KI-Tricks22 In der Kategorie Datenanalyse und -extraktion22 In der Kategorie Domänenspezifisch17 In der Kategorie Rätsellösen15 In der Kategorie Allgemeine Intelligenz14 In der Kategorie Allgemeinwissen14 In der Kategorie Befolgung von Anweisungen5
104/104
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | API-Fehler-Anzahl | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #80 | Inkling medium | Thinkingmachines | 1 | 8.0 | $0.383 | 15/22 | 15.7s |
| #201 | Mimo V2 PRO medium | Xiaomi | 1 | 6.3 | $0.333 | 12/21 | 22.2s |
| #53 | DeepSeek V4.1 Flash high | DeepSeek | 1 | 8.5 | $0.287 | 15/22 | 32.8s |
| #78 | DeepSeek V4 Flash 0731 high | DeepSeek | 1 | 8.0 | $0.279 | 14/22 | 114.9s |
| #54 | DeepSeek V4.1 Flash medium | DeepSeek | 1 | 8.5 | $0.272 | 15/22 | 32.2s |
| #52 | DeepSeek V4.1 Flash low | DeepSeek | 1 | 8.5 | $0.224 | 15/22 | 26.8s |
| #170 | MiMo-V2.5-Pro medium | Xiaomi | 1 | 6.8 | $0.221 | 11/22 | 48.7s |
| #289 | MiniMax M2.7 medium | Minimax | 1 | 5.0 | $0.208 | 5/22 | 43.2s |
| #262 | DeepSeek V4.1 Flash none | DeepSeek | 1 | 5.4 | $0.185 | 7/22 | 14.9s |
| #214 | Qwen3.5-Flash medium | Qwen | 1 | 6.1 | $0.142 | 11/22 | 84.4s |
| #167 | Solar Pro 4 medium | Upstage | 1 | 6.8 | $0.140 | 12/22 | 127.6s |
| #146 | Solar Pro 4 high | Upstage | 1 | 7.1 | $0.138 | 11/22 | 120.6s |
| #232 | Hy3 preview high | Tencent | 7 | 5.9 | $0.135 | 11/21 | 56.6s |
| #229 | Step 3.5 Flash medium | Stepfun | 1 | 5.9 | $0.132 | 10/21 | 191.6s |
| #166 | Solar Pro 4 low | Upstage | 1 | 6.8 | $0.130 | 11/22 | 136.1s |