Werkzeugaufrufe-Ranking
Sieh, welche KI-Modelle bei Werkzeugaufrufe am besten abschneiden, welche zuverlässig bleiben und wo die größten Unterschiede liegen. Sortieren nach: Antwortzeit (Durchschnitt) ↑.
Angezeigte Modelle
15
Durchschnittlicher Wert für Werkzeugaufrufe-Score
8.8
Bestes Modell
Kimi K3 3.0
311/311
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Werkzeugaufrufe-Score | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #43 | Grok 4.5 medium | X AI | 10.0 | 8.5 | $2.042 | 1/1 | 6.57s |
| #19 | Qwen3.7 Max medium | Qwen | 10.0 | 9.1 | $1.157 | 1/1 | 6.63s |
| #172 | LongCat 2.0 none | Meituan | 10.0 | 6.4 | $0.044 | 1/1 | 6.64s |
| #276 | Trinity Large Preview none | Arcee AI | 10.0 | 4.8 | $0.008 | 1/1 | 6.67s |
| #91 | GPT-5.6 Terra low | OpenAI | 4.7 | 7.5 | $0.420 | 0/1 | 6.69s |
| #229 | Qwen3.6 27B none | Qwen | 9.5 | 5.5 | $0.116 | 1/1 | 6.74s |
| #181 | Claude Sonnet 5 none | Anthropic | 10.0 | 6.1 | $0.548 | 1/1 | 6.80s |
| #78 | Claude Opus 4.8 low | Anthropic | 10.0 | 7.8 | $2.089 | 1/1 | 6.85s |
| #184 | gpt-oss-120b medium | OpenAI | 9.8 | 6.1 | $0.020 | 1/1 | 6.91s |
| #227 | Nemotron 3.5 Lightning high | NVIDIA | 10.0 | 5.6 | $0.134 | 1/1 | 6.92s |
| #171 | Dots 3 Note Preview high | Dots Studio | 10.0 | 6.4 | $0.000 | 1/1 | 6.96s |
| #38 | Muse Spark 1.1 medium | Meta | 9.8 | 8.6 | $1.420 | 1/1 | 6.99s |
| #275 | GLM 4.7 Flash none | Z.ai | 2.8 | 4.8 | $0.016 | 0/1 | 7.05s |
| #10 | GPT-5.6 Sol high | OpenAI | 10.0 | 9.4 | $0.446 | 1/1 | 7.08s |
| #143 | Solar Pro 4 low | Upstage | 10.0 | 6.8 | $0.044 | 1/1 | 7.12s |