AI BENCHY Categorie
Toolaanroepen-ranglijst
Zie welke AI-modellen het best presteren op Toolaanroepen, welke betrouwbaar blijven en waar de grootste verschillen zitten. Sorteren op: Correcte tests โ.
169/169
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Toolaanroepen-score | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #158 | Hy3 preview none | Tencent | 10.0 | 4.3 | $0.003 | 1/1 | 33.8s |
| #159 | MiMo-V2-Flash none | Xiaomi | 10.0 | 4.3 | $0.025 | 1/1 | 2.28s |
| #163 | Granite 4.1 8B none | IBM Granite | 10.0 | 4.0 | $0.003 | 1/1 | 2.17s |
| #165 | Qwen3.5-9B medium | Qwen | 10.0 | 3.8 | $0.036 | 1/1 | 4.31s |