AI BENCHY
Your ad here

AI BENCHY Kategorie

Werkzeugaufrufe-Ranking

Sieh, welche KI-Modelle bei Werkzeugaufrufe am besten abschneiden, welche zuverlässig bleiben und wo die größten Unterschiede liegen. Sortieren nach: Metrik ↑.

Angezeigte Modelle

8

Durchschnittlicher Wert für Werkzeugaufrufe-Score

8.7

Bestes Modell

Grok 4.1 Fast 2.8
Rang Modell Unternehmen Werkzeugaufrufe-Score Punktzahl Korrekte Tests Antwortzeit (Durchschnitt)
#89 GPT-4o-mini none OpenAI 10.0 4.9 1/1 2.51s
#90 Qwen3.5-9B none Qwen 10.0 4.8 1/1 1.27s
#91 Mercury 2 none Inception 10.0 4.8 1/1 1.27s
#92 Qwen3 Coder Next medium Qwen 10.0 4.7 1/1 2.64s
#93 GLM 4.7 Flash medium Z.ai 10.0 4.6 1/1 15.9s
#94 MiMo-V2-Flash none Xiaomi 10.0 4.5 1/1 2.28s
#96 GPT-5.4 Nano none OpenAI 10.0 4.5 1/1 3.40s
#97 Qwen3.5-9B medium Qwen 10.0 4.4 1/1 4.31s

Top-Modelle nach Werkzeugaufrufe-Score

Werkzeugaufrufe-Score vs. Gesamtkosten

Top-Modelle nach Antwortzeit (Durchschnitt)