Échecs Appel d'outil invalide
Voyez quels modèles d'IA rencontrent le plus souvent Appel d'outil invalide, pour repérer les risques de fiabilité avant de choisir. Trier par: Coût total ↑.
131/131
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Nombre de Appel d'outil invalide | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #231 | Qwen3.8 27B none | Qwen | 1 | 5.5 | ~$0.006 | 9/22 | 3.12s |
| #298 | Granite 4.1 8B none | IBM Granite | 2 | 4.0 | $0.007 | 2/22 | 1.44s |
| #299 | Nemotron 3.5 Lightning none | NVIDIA | 2 | 4.0 | $0.007 | 3/22 | 1.21s |
| #242 | Laguna XS 2.1 none | Poolside | 1 | 5.3 | $0.008 | 5/22 | 1.55s |
| #287 | Laguna M.1 none | Poolside | 1 | 4.4 | $0.009 | 4/19 | 2.89s |
| #239 | DeepSeek V4 Flash 0731 none | DeepSeek | 2 | 5.4 | $0.011 | 4/22 | 20.7s |
| #223 | Gemma 4 26B A4B none | 1 | 5.6 | $0.015 | 9/22 | 7.58s | |
| #206 | GLM 5.3 Flash low | Z.ai | 1 | 5.9 | $0.015 | 10/22 | 9.65s |
| #294 | Laguna Xs.2 medium | Poolside | 1 | 4.1 | $0.015 | 6/19 | 6.73s |
| #244 | Ling-2.6-1T none | Inclusionai | 1 | 5.3 | $0.016 | 4/22 | 8.59s |
| #275 | GLM 4.7 Flash none | Z.ai | 2 | 4.8 | $0.016 | 5/22 | 8.81s |
| #195 | Gemini 2.5 Flash none | 1 | 6.0 | $0.017 | 8/22 | 6.19s | |
| #265 | Mercury 2.5 Preview none | Inception | 1 | 4.9 | $0.018 | 4/22 | 3.51s |
| #185 | Qwen3.7 Flash none | Qwen | 1 | 6.1 | $0.019 | 7/22 | 10.1s |
| #184 | gpt-oss-120b medium | OpenAI | 1 | 6.1 | $0.020 | 9/22 | 20.8s |