Échecs Appel d'outil invalide
Voyez quels modèles d'IA rencontrent le plus souvent Appel d'outil invalide, pour repérer les risques de fiabilité avant de choisir. Trier par: Score ↑.
131/131
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Nombre de Appel d'outil invalide | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #244 | Ling-2.6-1T none | Inclusionai | 1 | 5.3 | $0.016 | 4/22 | 8.59s |
| #242 | Laguna XS 2.1 none | Poolside | 1 | 5.3 | $0.008 | 5/22 | 1.55s |
| #241 | Inkling Small none | Thinkingmachines | 1 | 5.3 | $0.054 | 5/22 | 1.51s |
| #239 | DeepSeek V4 Flash 0731 none | DeepSeek | 2 | 5.4 | $0.011 | 4/22 | 20.7s |
| #240 | Laguna S 2.1 high | Poolside | 2 | 5.4 | $0.114 | 4/22 | 111.6s |
| #236 | GPT-5.6 Luna none | OpenAI | 1 | 5.4 | $0.029 | 6/22 | 1.50s |
| #234 | Laguna S 2.1 medium | Poolside | 2 | 5.4 | $0.053 | 4/22 | 58.4s |
| #233 | DeepSeek V4 Flash 0423 none | DeepSeek | 2 | 5.4 | $0.037 | 4/22 | 36.2s |
| #231 | Qwen3.8 27B none | Qwen | 1 | 5.5 | ~$0.006 | 9/22 | 3.12s |
| #229 | Qwen3.6 27B none | Qwen | 2 | 5.5 | $0.116 | 7/22 | 10.6s |
| #227 | Nemotron 3.5 Lightning high | NVIDIA | 1 | 5.6 | $0.134 | 5/22 | 58.3s |
| #223 | Gemma 4 26B A4B none | 1 | 5.6 | $0.015 | 9/22 | 7.58s | |
| #218 | Qwen3.5-122B-A10B none | Qwen | 1 | 5.7 | $0.283 | 6/22 | 12.9s |
| #216 | GLM 5.1 none | Z.ai | 1 | 5.7 | $0.164 | 8/22 | 6.74s |
| #215 | Ling-3.0-flash none | Inclusionai | 1 | 5.7 | $0.004 | 6/22 | 3.56s |