Classement Appel d'outils
Voyez quels modèles d'IA réussissent le mieux sur Appel d'outils, lesquels restent fiables et où les écarts sont les plus marqués.
226/226
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Appel d'outils | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #37 | GPT-5.2 Chat none | OpenAI | 10.0 | 8.0 | $0.604 | 1/1 | 4.68s |
| #38 | GLM 5.2 high | Z.ai | 10.0 | 8.0 | $0.802 | 1/1 | 9.25s |
| #41 | GPT-5.6 Terra high | OpenAI | 10.0 | 8.0 | $1.055 | 1/1 | 4.97s |
| #42 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 7.9 | $0.234 | 1/1 | 12.4s |
| #43 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.267 | 1/1 | 15.0s |
| #44 | Qwen3.6 Plus medium | Qwen | 10.0 | 7.8 | $0.405 | 1/1 | 5.87s |
| #45 | GLM 5.2 medium | Z.ai | 10.0 | 7.8 | $0.184 | 1/1 | 20.4s |
| #46 | GPT-5.6 Terra medium | OpenAI | 10.0 | 7.8 | $0.676 | 1/1 | 5.09s |
| #47 | Claude Sonnet 4.6 medium | Anthropic | 10.0 | 7.8 | $2.057 | 1/1 | 7.48s |
| #48 | Claude Opus 4.8 low | Anthropic | 10.0 | 7.8 | $2.077 | 1/1 | 6.85s |
| #49 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.307 | 1/1 | 15.9s |
| #50 | Claude Opus 4.6 medium | Anthropic | 10.0 | 7.7 | $3.059 | 1/1 | 9.73s |
| #51 | GPT-5.6 Luna high | OpenAI | 10.0 | 7.7 | $1.017 | 1/1 | 4.98s |
| #52 | DeepSeek V4 Flash high | DeepSeek | 10.0 | 7.7 | $0.041 | 1/1 | 74.7s |
| #54 | MiniMax M3 medium | Minimax | 10.0 | 7.6 | $0.286 | 1/1 | 11.9s |