Classement Appel d'outils
Voyez quels modèles d'IA réussissent le mieux sur Appel d'outils, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Temps de réponse (moy.) ↑.
311/311
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Appel d'outils | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #43 | Grok 4.5 medium | X AI | 10.0 | 8.5 | $2.042 | 1/1 | 6.57s |
| #19 | Qwen3.7 Max medium | Qwen | 10.0 | 9.1 | $1.157 | 1/1 | 6.63s |
| #172 | LongCat 2.0 none | Meituan | 10.0 | 6.4 | $0.044 | 1/1 | 6.64s |
| #276 | Trinity Large Preview none | Arcee AI | 10.0 | 4.8 | $0.008 | 1/1 | 6.67s |
| #91 | GPT-5.6 Terra low | OpenAI | 4.7 | 7.5 | $0.420 | 0/1 | 6.69s |
| #229 | Qwen3.6 27B none | Qwen | 9.5 | 5.5 | $0.116 | 1/1 | 6.74s |
| #181 | Claude Sonnet 5 none | Anthropic | 10.0 | 6.1 | $0.548 | 1/1 | 6.80s |
| #78 | Claude Opus 4.8 low | Anthropic | 10.0 | 7.8 | $2.089 | 1/1 | 6.85s |
| #184 | gpt-oss-120b medium | OpenAI | 9.8 | 6.1 | $0.020 | 1/1 | 6.91s |
| #227 | Nemotron 3.5 Lightning high | NVIDIA | 10.0 | 5.6 | $0.134 | 1/1 | 6.92s |
| #171 | Dots 3 Note Preview high | Dots Studio | 10.0 | 6.4 | $0.000 | 1/1 | 6.96s |
| #38 | Muse Spark 1.1 medium | Meta | 9.8 | 8.6 | $1.420 | 1/1 | 6.99s |
| #275 | GLM 4.7 Flash none | Z.ai | 2.8 | 4.8 | $0.016 | 0/1 | 7.05s |
| #10 | GPT-5.6 Sol high | OpenAI | 10.0 | 9.4 | $0.446 | 1/1 | 7.08s |
| #143 | Solar Pro 4 low | Upstage | 10.0 | 6.8 | $0.044 | 1/1 | 7.12s |