Werkzeugaufrufe-Ranking
Sieh, welche KI-Modelle bei Werkzeugaufrufe am besten abschneiden, welche zuverlässig bleiben und wo die größten Unterschiede liegen. Sortieren nach: Antwortzeit (Durchschnitt) ↑.
Angezeigte Modelle
15
Durchschnittlicher Wert für Werkzeugaufrufe-Score
8.8
Bestes Modell
Kimi K3 3.0
311/311
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Werkzeugaufrufe-Score | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #221 | GLM 5V Turbo none | Z.ai | 10.0 | 5.6 | $0.052 | 1/1 | 4.86s |
| #305 | Ling 3.0 Tiny medium | Inclusionai | 10.0 | 3.8 | $0.000 | 1/1 | 4.91s |
| #250 | Nemotron 3.5 Lightning medium | NVIDIA | 10.0 | 5.1 | $0.156 | 1/1 | 4.92s |
| #7 | Gemini 3.5 Flash high | 9.8 | 9.4 | $2.011 | 1/1 | 4.96s | |
| #11 | GPT-5.5 low | OpenAI | 10.0 | 9.3 | $1.257 | 1/1 | 4.96s |
| #65 | GPT-5.6 Terra high | OpenAI | 10.0 | 8.0 | $0.836 | 1/1 | 4.97s |
| #86 | GPT-5.6 Luna high | OpenAI | 10.0 | 7.6 | $0.179 | 1/1 | 4.98s |
| #107 | Gemini 3 Flash Preview low | 10.0 | 7.4 | $0.185 | 1/1 | 4.99s | |
| #123 | Muse Glimmer 30B low | Meta | 10.0 | 7.1 | $0.152 | 1/1 | 5.04s |
| #270 | Nemotron 3.5 Lightning low | NVIDIA | 10.0 | 4.8 | $0.140 | 1/1 | 5.08s |
| #74 | GPT-5.6 Terra medium | OpenAI | 10.0 | 7.8 | $0.523 | 1/1 | 5.09s |
| #274 | KAT-Coder-Air V2.5 none | Kwaipilot | 10.0 | 4.8 | $0.070 | 1/1 | 5.13s |
| #194 | Trinity Large Thinking low | Arcee AI | 10.0 | 6.0 | $0.625 | 1/1 | 5.19s |
| #189 | Trinity Large Thinking medium | Arcee AI | 10.0 | 6.1 | $0.756 | 1/1 | 5.26s |
| #169 | Qwen3.6 Max Preview none | Qwen | 10.0 | 6.4 | $0.228 | 1/1 | 5.27s |