AI BENCHY
Your ad here

AI BENCHY Kategoriefehler

Domänenspezifisch: Zeitüberschreitung

Domänenspezifisch
Zeitüberschreitung

Sieh, welche KI-Modelle bei Domänenspezifisch am ehesten auf Zeitüberschreitung stoßen, damit du Schwachstellen schneller erkennst.

Angezeigte Modelle

15

Gesamtfehler

31

Am stärksten betroffenes Modell

Seed-2.0-Mini 3
Rang Modell Unternehmen Zeitüberschreitung-Anzahl Kategorie-Score Korrekte Tests Antwortzeit (Durchschnitt)
#39 Seed-2.0-Mini medium Bytedance Seed 3 3.0 0/3 0ms
#97 Qwen3.5-9B medium Qwen 3 3.6 0/3 137.7s
#34 Kimi K2.6 medium Moonshot AI 2 5.3 1/3 202.4s
#43 Qwen3.5-35B-A3B medium Qwen 2 4.1 0/3 88.3s
#80 MiniMax M2.7 medium Minimax 2 3.0 0/3 19.0s
#3 Claude Opus 4.7 medium Anthropic 1 7.7 2/3 1.17s
#8 Qwen3.5 Plus 2026-02-15 medium Qwen 1 5.3 1/3 17.5s
#10 Qwen3.5-27B medium Qwen 1 5.3 1/3 79.5s
#13 GLM 5 medium Z.ai 1 3.5 0/3 0ms
#18 GLM 5 Turbo medium Z.ai 1 2.9 0/3 71.1s
#23 MiMo-V2-Pro medium Xiaomi 1 5.3 1/3 6.00s
#24 Gemma 4 26B A4B medium Google 1 2.9 0/3 23.6s
#26 Claude Sonnet 4.6 medium Anthropic 1 2.9 0/3 0ms
#27 DeepSeek V3.2 medium DeepSeek 1 5.3 1/3 39.3s
#32 Qwen3.5-Flash medium Qwen 1 5.3 1/3 146.5s

Top-Modelle nach Zeitüberschreitung-Anzahl

Zeitüberschreitung-Anzahl vs Punktzahl

Top-Modelle nach Antwortzeit (Durchschnitt)

Top-Modelle nach Geschätzte verschwendete Kosten