Werkzeugaufrufe-Ranking
Sieh, welche KI-Modelle bei Werkzeugaufrufe am besten abschneiden, welche zuverlässig bleiben und wo die größten Unterschiede liegen. Sortieren nach: Antwortzeit (Durchschnitt) ↑.
Angezeigte Modelle
15
Durchschnittlicher Wert für Werkzeugaufrufe-Score
8.8
Bestes Modell
Kimi K3 3.0
311/311
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Werkzeugaufrufe-Score | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #271 | GPT-5.4 Nano none | OpenAI | 10.0 | 4.8 | $0.041 | 1/1 | 3.40s |
| #252 | Mistral Small 4 medium | Mistral | 10.0 | 5.1 | $0.097 | 1/1 | 3.50s |
| #182 | Gemini 3.1 Flash Lite minimal | 10.0 | 6.1 | $0.047 | 1/1 | 3.51s | |
| #113 | Qwen3.7 Plus none | Qwen | 10.0 | 7.3 | $0.106 | 1/1 | 3.54s |
| #158 | Qwen3.5-27B none | Qwen | 10.0 | 6.6 | $0.058 | 1/1 | 3.54s |
| #44 | Muse Spark 1.2 low | Meta | 10.0 | 8.4 | $0.655 | 1/1 | 3.58s |
| #258 | North Mini Code none | Cohere | 9.5 | 5.1 | $0.000 | 1/1 | 3.64s |
| #200 | Qwen3.5-Flash none | Qwen | 10.0 | 6.0 | $0.073 | 1/1 | 3.67s |
| #127 | GPT-5.6 Sol none | OpenAI | 10.0 | 7.0 | $0.201 | 1/1 | 3.70s |
| #100 | Gemini 3.1 Flash Lite Preview medium | 10.0 | 7.4 | $0.117 | 1/1 | 3.80s | |
| #21 | Gemini 3.5 Flash medium | 10.0 | 9.0 | $0.665 | 1/1 | 3.81s | |
| #210 | Solar Pro 4 none | Upstage | 10.0 | 5.8 | $0.006 | 1/1 | 3.83s |
| #37 | Muse Spark 1.2 medium | Meta | 10.0 | 8.6 | $1.339 | 1/1 | 3.89s |
| #130 | GPT-5.5 none | OpenAI | 10.0 | 7.0 | $0.544 | 1/1 | 3.90s |
| #101 | Qwen3.7 Max none | Qwen | 10.0 | 7.4 | $0.197 | 1/1 | 3.92s |