AI BENCHY
Advertise here

AI BENCHY Fehler

Ungültiger Werkzeugaufruf-Fehler

Sieh, bei welchen KI-Modellen Ungültiger Werkzeugaufruf besonders häufig auftritt, damit du Zuverlässigkeitsrisiken vor der Auswahl erkennst.

Angezeigte Modelle

9

Gesamtfehler

26

Am stärksten betroffenes Modell

GLM 5V Turbo 2
Rang Modell Unternehmen Ungültiger Werkzeugaufruf-Anzahl Punktzahl Korrekte Tests Antwortzeit (Durchschnitt)
#136 Elephant Alpha medium Openrouter 1 5.1 6/21 1.27s
#137 Elephant Alpha none Openrouter 1 5.1 5/21 1.22s
#139 DeepSeek V4 Flash none DeepSeek 1 5.0 5/21 26.8s
#145 Laguna M.1 none Poolside 1 4.8 4/19 2.89s
#146 Laguna Xs.2 none Poolside 1 4.8 5/19 806ms
#154 Qwen3.5-9B none Qwen 1 4.6 4/21 1.89s
#158 GLM 4.7 Flash medium Z.ai 1 4.4 4/21 35.1s
#159 Ling-2.6-1T none Inclusionai 1 4.3 3/21 7.72s
#163 Granite 4.1 8B none IBM Granite 1 4.0 2/21 728ms

Top-Modelle nach Ungültiger Werkzeugaufruf-Anzahl

Ungültiger Werkzeugaufruf-Anzahl vs Punktzahl

Top-Modelle nach Antwortzeit (Durchschnitt)