Toolaanroepen-ranglijst
Zie welke AI-modellen het best presteren op Toolaanroepen, welke betrouwbaar blijven en waar de grootste verschillen zitten. Sorteren op: Responstijd (gem.) ↓.
311/311
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Toolaanroepen-score | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #21 | Gemini 3.5 Flash medium | 10.0 | 9.0 | $0.665 | 1/1 | 3.81s | |
| #100 | Gemini 3.1 Flash Lite Preview medium | 10.0 | 7.4 | $0.117 | 1/1 | 3.80s | |
| #127 | GPT-5.6 Sol none | OpenAI | 10.0 | 7.0 | $0.201 | 1/1 | 3.70s |
| #200 | Qwen3.5-Flash none | Qwen | 10.0 | 6.0 | $0.073 | 1/1 | 3.67s |
| #258 | North Mini Code none | Cohere | 9.5 | 5.1 | $0.000 | 1/1 | 3.64s |
| #44 | Muse Spark 1.2 low | Meta | 10.0 | 8.4 | $0.655 | 1/1 | 3.58s |
| #113 | Qwen3.7 Plus none | Qwen | 10.0 | 7.3 | $0.106 | 1/1 | 3.54s |
| #158 | Qwen3.5-27B none | Qwen | 10.0 | 6.6 | $0.058 | 1/1 | 3.54s |
| #182 | Gemini 3.1 Flash Lite minimal | 10.0 | 6.1 | $0.047 | 1/1 | 3.51s | |
| #252 | Mistral Small 4 medium | Mistral | 10.0 | 5.1 | $0.097 | 1/1 | 3.50s |
| #271 | GPT-5.4 Nano none | OpenAI | 10.0 | 4.8 | $0.041 | 1/1 | 3.40s |
| #294 | Laguna Xs.2 medium | Poolside | 4.7 | 4.1 | $0.015 | 0/1 | 3.39s |
| #168 | Gemini 3.1 Flash Lite Preview none | 10.0 | 6.4 | $0.052 | 1/1 | 3.39s | |
| #148 | Gemini 3 Flash Preview none | 10.0 | 6.8 | $0.085 | 1/1 | 3.35s | |
| #164 | Qwen3.5 Plus 2026-02-15 none | Qwen | 10.0 | 6.6 | $0.073 | 1/1 | 3.33s |