Ongeldige toolaanroep-fouten
Zie welke AI-modellen het vaakst tegen Ongeldige toolaanroep aanlopen, zodat je betrouwbaarheidsrisico's ziet voordat je kiest. Sorteren op: Responstijd (gem.) ↑.
131/131
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Ongeldige toolaanroep-aantal | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #236 | Qwen3.8 27B none | Qwen | 1 | 5.5 | ~$0.006 | 9/22 | 3.12s |
| #253 | Inkling none | Thinkingmachines | 1 | 5.2 | $0.147 | 6/22 | 3.47s |
| #270 | Mercury 2.5 Preview none | Inception | 1 | 4.9 | $0.018 | 4/22 | 3.51s |
| #252 | Dots 3 Note Preview none | Dots Studio | 1 | 5.2 | $0.000 | 3/22 | 3.53s |
| #220 | Ling-3.0-flash none | Inclusionai | 1 | 5.7 | $0.004 | 6/22 | 3.56s |
| #195 | Qwen3.6 Flash none | Qwen | 2 | 6.1 | $0.062 | 7/22 | 3.73s |
| #168 | Mercury 2.5 Preview high | Inception | 1 | 6.6 | $0.030 | 12/22 | 4.01s |
| #117 | Gemini 3.1 Flash Lite medium | 1 | 7.3 | $0.120 | 13/22 | 4.38s | |
| #105 | Gemini 3.1 Flash Lite Preview medium | 1 | 7.4 | $0.117 | 14/22 | 4.59s | |
| #193 | Inkling low | Thinkingmachines | 2 | 6.1 | $0.187 | 10/22 | 5.11s |
| #77 | Gemini 3.5 Flash Lite medium | 1 | 7.8 | $0.272 | 14/22 | 5.12s | |
| #185 | GPT-5.6 Luna low | OpenAI | 1 | 6.2 | $0.051 | 10/22 | 5.20s |
| #96 | GPT-5.6 Terra low | OpenAI | 1 | 7.5 | $0.420 | 13/22 | 5.45s |
| #33 | Gemini 3.5 Flash low | 1 | 8.8 | $0.449 | 18/22 | 5.76s | |
| #200 | Gemini 2.5 Flash none | 1 | 6.0 | $0.017 | 8/22 | 6.19s |