Échecs Appel d'outil invalide
Voyez quels modèles d'IA rencontrent le plus souvent Appel d'outil invalide, pour repérer les risques de fiabilité avant de choisir. Trier par: Score ↑.
83/83
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Nombre de Appel d'outil invalide | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #27 | Muse Spark 1.1 high | Meta | 2 | 8.1 | $1.694 | 12/22 | 31.5s |
| #24 | Muse Spark 1.1 low | Meta | 1 | 8.3 | $0.647 | 13/22 | 11.5s |
| #23 | Claude Sonnet 5 medium | Anthropic | 1 | 8.3 | $0.922 | 16/22 | 12.5s |
| #17 | Claude Fable 5 medium | Anthropic | 1 | 8.6 | $3.478 | 17/22 | 17.2s |
| #16 | Muse Spark 1.1 medium | Meta | 1 | 8.6 | $1.357 | 15/22 | 25.0s |
| #11 | Gemini 3.5 Flash low | 1 | 8.9 | $0.433 | 19/22 | 5.55s | |
| #8 | Qwen3.7 Max medium | Qwen | 1 | 9.2 | $1.116 | 18/22 | 40.6s |
| #2 | Gemini 3.5 Flash high | 1 | 9.5 | $1.976 | 20/22 | 15.1s |