Zeitüberschreitung-Fehler
Sieh, bei welchen KI-Modellen Zeitüberschreitung besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst. Sortieren nach: Punktzahl ↑.
Kategorien
In der Kategorie Domänenspezifisch42 In der Kategorie Programmierung29 In der Kategorie Rätsellösen11 In der Kategorie Kombiniert9 In der Kategorie Anti-KI-Tricks6 In der Kategorie Befolgung von Anweisungen5 In der Kategorie Allgemeine Intelligenz4 In der Kategorie Datenanalyse und -extraktion2 In der Kategorie Allgemeinwissen1
53/53
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Zeitüberschreitung-Anzahl | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #216 | North Mini Code medium | Cohere | 1 | 5.7 | $0.000 | 8/22 | 142.0s |
| #207 | Step 3.5 Flash medium | Stepfun | 1 | 5.9 | $0.132 | 10/21 | 191.6s |
| #204 | GPT-5 Nano medium | OpenAI | 1 | 6.0 | $0.118 | 8/22 | 54.2s |
| #192 | Qwen3.5-Flash medium | Qwen | 3 | 6.1 | $0.142 | 11/22 | 84.4s |
| #188 | Qwen3.5-35B-A3B medium | Qwen | 4 | 6.1 | $0.675 | 11/22 | 110.8s |
| #184 | Gemma 4 31B medium | 2 | 6.2 | $0.100 | 13/22 | 78.6s | |
| #182 | MiMo-V2-Flash medium | Xiaomi | 1 | 6.3 | $0.043 | 12/21 | 20.1s |
| #181 | Mimo V2 PRO medium | Xiaomi | 1 | 6.3 | $0.333 | 12/21 | 22.2s |
| #160 | LongCat 2.0 high | Meituan | 2 | 6.7 | $0.492 | 9/22 | 153.3s |
| #157 | LongCat 2.0 low | Meituan | 1 | 6.7 | $0.412 | 10/22 | 113.6s |
| #154 | Gemma 4 26B A4B medium | 2 | 6.8 | $0.092 | 15/22 | 104.9s | |
| #148 | Solar Pro 4 low | Upstage | 1 | 6.8 | $0.044 | 11/22 | 136.1s |
| #139 | Kimi K2.5 medium | Moonshot AI | 2 | 7.0 | $0.479 | 10/22 | 98.2s |
| #138 | Seed-2.0-Mini medium | Bytedance Seed | 4 | 7.0 | $0.116 | 11/22 | 93.1s |
| #134 | GLM 5.1 medium | Z.ai | 2 | 7.0 | $0.727 | 12/22 | 58.8s |