Ongeldige toolaanroep-fouten
Zie welke AI-modellen het vaakst tegen Ongeldige toolaanroep aanlopen, zodat je betrouwbaarheidsrisico's ziet voordat je kiest. Sorteren op: Correcte tests ↑.
131/131
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Ongeldige toolaanroep-aantal | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #298 | Grok 4.20 none | X AI | 1 | 4.1 | $0.057 | 6/18 | 1.11s |
| #194 | Trinity Large Thinking medium | Arcee AI | 2 | 6.1 | $0.756 | 8/22 | 85.4s |
| #199 | Trinity Large Thinking low | Arcee AI | 2 | 6.0 | $0.625 | 8/22 | 96.6s |
| #200 | Gemini 2.5 Flash none | 1 | 6.0 | $0.017 | 8/22 | 6.19s | |
| #202 | GPT-5.6 Terra none | OpenAI | 1 | 6.0 | $0.280 | 8/22 | 1.66s |
| #216 | North Mini Code medium | Cohere | 1 | 5.7 | $0.000 | 8/22 | 142.0s |
| #221 | GLM 5.1 none | Z.ai | 1 | 5.7 | $0.164 | 8/22 | 6.74s |
| #150 | DeepSeek V4 Pro none | DeepSeek | 1 | 6.8 | $0.220 | 9/22 | 11.7s |
| #171 | Laguna XS 2.1 medium | Poolside | 1 | 6.5 | $0.068 | 9/22 | 48.2s |
| #189 | gpt-oss-120b medium | OpenAI | 1 | 6.1 | $0.020 | 9/22 | 20.8s |
| #219 | Inkling Small low | Thinkingmachines | 2 | 5.7 | $0.055 | 9/22 | 2.07s |
| #228 | Gemma 4 26B A4B none | 1 | 5.6 | $0.015 | 9/22 | 7.58s | |
| #236 | Qwen3.8 27B none | Qwen | 1 | 5.5 | ~$0.006 | 9/22 | 3.12s |
| #136 | Mercury 2 medium | Inception | 1 | 7.0 | $0.094 | 10/22 | 2.95s |
| #139 | Kimi K2.5 medium | Moonshot AI | 1 | 7.0 | $0.479 | 10/22 | 98.2s |