Ongeldige toolaanroep-fouten
Zie welke AI-modellen het vaakst tegen Ongeldige toolaanroep aanlopen, zodat je betrouwbaarheidsrisico's ziet voordat je kiest. Sorteren op: Correcte tests ↑.
131/131
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Ongeldige toolaanroep-aantal | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #179 | Ling-3.0-flash high | Inclusionai | 2 | 6.4 | $0.021 | 12/22 | 13.7s |
| #56 | Muse Spark 1.1 low | Meta | 1 | 8.3 | $0.673 | 13/22 | 11.9s |
| #63 | Muse Glimmer 30B xhigh | Meta | 1 | 8.1 | $0.471 | 13/22 | 95.6s |
| #73 | Step 3.7 Flash medium | Stepfun | 1 | 7.9 | $0.495 | 13/22 | 23.5s |
| #84 | Qwen3.7 Flash high | Qwen | 1 | 7.8 | $0.052 | 13/22 | 41.4s |
| #89 | DeepSeek V4 Flash 0423 high | DeepSeek | 1 | 7.6 | $0.042 | 13/22 | 51.8s |
| #93 | Nemotron 3 Ultra medium | NVIDIA | 1 | 7.6 | $0.701 | 13/22 | 33.6s |
| #96 | GPT-5.6 Terra low | OpenAI | 1 | 7.5 | $0.420 | 13/22 | 5.45s |
| #100 | Qwen3.5-27B medium | Qwen | 1 | 7.5 | $0.982 | 13/22 | 113.3s |
| #116 | GLM 5.3 Flash high | Z.ai | 1 | 7.3 | $0.029 | 13/22 | 25.4s |
| #117 | Gemini 3.1 Flash Lite medium | 1 | 7.3 | $0.120 | 13/22 | 4.38s | |
| #155 | GLM 5.2 none | Z.ai | 1 | 6.7 | $0.153 | 13/22 | 9.65s |
| #158 | Gemini 3.5 Flash minimal | 2 | 6.7 | $0.300 | 13/22 | 2.65s | |
| #166 | Gemini 3.1 Flash Lite low | 1 | 6.6 | $0.621 | 13/22 | 16.2s | |
| #184 | Gemma 4 31B medium | 1 | 6.2 | $0.100 | 13/22 | 78.6s |