Classement Appel d'outils
Voyez quels modèles d'IA réussissent le mieux sur Appel d'outils, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Temps de réponse (moy.) ↓.
311/311
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Appel d'outils | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #26 | Muse Spark 1.3 high | Meta | 9.6 | 8.9 | $1.653 | 1/1 | 33.9s |
| #295 | Hy3 preview none | Tencent | 10.0 | 4.0 | $0.007 | 1/1 | 33.8s |
| #199 | GPT-5 Nano medium | OpenAI | 10.0 | 6.0 | $0.118 | 1/1 | 33.3s |
| #105 | Qwen3.8 2.4T A95B high | Qwen | 10.0 | 7.4 | $2.357 | 1/1 | 32.9s |
| #134 | Kimi K2.5 medium | Moonshot AI | 10.0 | 7.0 | $0.479 | 1/1 | 31.7s |
| #29 | Muse Spark 1.3 medium | Meta | 9.6 | 8.8 | $1.469 | 1/1 | 28.3s |
| #117 | KAT-Coder-Pro V2.5 high | Kwaipilot | 10.0 | 7.2 | $0.506 | 1/1 | 28.0s |
| #177 | MiMo-V2-Flash medium | Xiaomi | 10.0 | 6.3 | $0.043 | 1/1 | 27.8s |
| #278 | Grok 4.1 Fast medium | X AI | 2.8 | 4.7 | $0.069 | 0/1 | 27.7s |
| #49 | Seed 2.1 Turbo medium | Bytedance Seed | 10.0 | 8.4 | $1.951 | 1/1 | 27.5s |
| #18 | Seed 2.1 Turbo low | Bytedance Seed | 10.0 | 9.1 | $1.546 | 1/1 | 27.4s |
| #27 | Seed 2.1 Turbo high | Bytedance Seed | 10.0 | 8.9 | $1.797 | 1/1 | 26.0s |
| #56 | Qwen3.8 2.4T A95B low | Qwen | 10.0 | 8.1 | $2.672 | 1/1 | 25.9s |
| #244 | Ling-2.6-1T none | Inclusionai | 3.0 | 5.3 | $0.016 | 0/1 | 25.7s |
| #13 | Gemini 3.1 Pro Preview medium | 10.0 | 9.2 | $1.352 | 1/1 | 23.1s |