Werkzeugaufrufe-Ranking
Sieh, welche KI-Modelle bei Werkzeugaufrufe am besten abschneiden, welche zuverlässig bleiben und wo die größten Unterschiede liegen. Sortieren nach: Metrik ↑.
Angezeigte Modelle
15
Durchschnittlicher Wert für Werkzeugaufrufe-Score
8.8
Bestes Modell
Hy3 preview 2.8
311/311
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Werkzeugaufrufe-Score | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #208 | Seed 2.1 Turbo none | Bytedance Seed | 10.0 | 5.9 | $0.092 | 1/1 | 20.3s |
| #209 | GPT-5.4 none | OpenAI | 10.0 | 5.8 | $0.397 | 1/1 | 2.75s |
| #210 | Solar Pro 4 none | Upstage | 10.0 | 5.8 | $0.006 | 1/1 | 3.83s |
| #211 | North Mini Code medium | Cohere | 10.0 | 5.7 | $0.000 | 1/1 | 3.93s |
| #212 | Nemotron 3 Super medium | NVIDIA | 10.0 | 5.7 | $0.050 | 1/1 | 39.7s |
| #213 | GLM 5 none | Z.ai | 10.0 | 5.7 | $0.027 | 1/1 | 11.1s |
| #215 | Ling-3.0-flash none | Inclusionai | 10.0 | 5.7 | $0.004 | 1/1 | 2.85s |
| #216 | GLM 5.1 none | Z.ai | 10.0 | 5.7 | $0.164 | 1/1 | 10.7s |
| #217 | Kimi K2.6 none | Moonshot AI | 10.0 | 5.7 | $0.233 | 1/1 | 4.46s |
| #218 | Qwen3.5-122B-A10B none | Qwen | 10.0 | 5.7 | $0.283 | 1/1 | 2.04s |
| #219 | Gemini 3.1 Flash Lite high | 10.0 | 5.6 | $2.044 | 1/1 | 6.44s | |
| #220 | KAT-Coder-Air V2.5 high | Kwaipilot | 10.0 | 5.6 | $0.077 | 1/1 | 4.77s |
| #221 | GLM 5V Turbo none | Z.ai | 10.0 | 5.6 | $0.052 | 1/1 | 4.86s |
| #222 | Owl Alpha medium | Openrouter | 10.0 | 5.6 | $0.000 | 1/1 | 8.26s |
| #223 | Gemma 4 26B A4B none | 10.0 | 5.6 | $0.015 | 1/1 | 57.1s |