Échecs Appel d'outil invalide
Voyez quels modèles d'IA rencontrent le plus souvent Appel d'outil invalide, pour repérer les risques de fiabilité avant de choisir. Trier par: Coût total ↑.
131/131
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Nombre de Appel d'outil invalide | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #193 | Inkling low | Thinkingmachines | 2 | 6.1 | $0.187 | 10/22 | 5.11s |
| #264 | MiniMax M2.7 medium | Minimax | 1 | 5.0 | $0.208 | 5/22 | 43.2s |
| #150 | DeepSeek V4 Pro none | DeepSeek | 1 | 6.8 | $0.220 | 9/22 | 11.7s |
| #152 | MiMo-V2.5-Pro medium | Xiaomi | 1 | 6.8 | $0.221 | 11/22 | 48.7s |
| #151 | GLM 5.3 low | Z.ai | 1 | 6.8 | $0.257 | 12/22 | 13.6s |
| #77 | Gemini 3.5 Flash Lite medium | 1 | 7.8 | $0.272 | 14/22 | 5.12s | |
| #75 | Qwen3.7 Plus medium | Qwen | 1 | 7.9 | $0.277 | 15/22 | 53.5s |
| #202 | GPT-5.6 Terra none | OpenAI | 1 | 6.0 | $0.280 | 8/22 | 1.66s |
| #223 | Qwen3.5-122B-A10B none | Qwen | 1 | 5.7 | $0.283 | 6/22 | 12.9s |
| #158 | Gemini 3.5 Flash minimal | 2 | 6.7 | $0.300 | 13/22 | 2.65s | |
| #289 | MiniMax M2.5 medium | Minimax | 1 | 4.6 | $0.327 | 5/22 | 69.1s |
| #69 | Inkling medium | Thinkingmachines | 1 | 8.0 | $0.383 | 15/22 | 15.7s |
| #129 | Step 3.7 Flash low | Stepfun | 1 | 7.1 | $0.390 | 11/22 | 17.9s |
| #96 | GPT-5.6 Terra low | OpenAI | 1 | 7.5 | $0.420 | 13/22 | 5.45s |
| #33 | Gemini 3.5 Flash low | 1 | 8.8 | $0.449 | 18/22 | 5.76s |