Classement Suivi des instructions
Voyez quels modèles d'IA réussissent le mieux sur Suivi des instructions, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Métrique ↑.
216/216
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Suivi des instructions | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #58 | GPT-5.3 Chat none | OpenAI | 9.8 | 7.5 | $0.571 | 2/2 | 3.51s |
| #60 | GPT-5.4 Mini medium | OpenAI | 9.8 | 7.5 | $0.756 | 2/2 | 2.13s |
| #71 | Step 3.7 Flash low | Stepfun | 9.8 | 7.3 | $0.454 | 2/2 | 1.58s |
| #79 | Grok 4.20 medium | X AI | 9.8 | 7.1 | $0.777 | 2/2 | 4.26s |
| #90 | Step 3.7 Flash high | Stepfun | 9.8 | 6.9 | $1.207 | 2/2 | 1.52s |
| #95 | Gemini 3.5 Flash-Lite low | 9.8 | 6.7 | $0.145 | 2/2 | 869ms | |
| #101 | GLM 5.2 none | Z.ai | 9.8 | 6.6 | $0.128 | 2/2 | 3.84s |
| #103 | Qwen3.6 Max Preview none | Qwen | 9.8 | 6.6 | $0.231 | 2/2 | 1.40s |
| #104 | Gemini 3.5 Flash-Lite medium | 9.8 | 6.5 | $0.369 | 2/2 | 1.59s | |
| #108 | Laguna XS 2.1 medium | Poolside | 9.8 | 6.5 | $0.068 | 2/2 | 2.57s |
| #114 | Ring-2.6-1T medium | Inclusionai | 9.8 | 6.3 | $0.103 | 2/2 | 11.8s |
| #129 | Inkling low | Thinkingmachines | 9.8 | 6.1 | $0.187 | 2/2 | 1.81s |
| #134 | GPT-5 Nano medium | OpenAI | 9.8 | 6.1 | $0.114 | 2/2 | 15.6s |
| #137 | Grok 4.20 Beta medium | X AI | 9.8 | 6.0 | $0.750 | 2/2 | 4.89s |
| #139 | Gemini 3 PRO Preview medium | 9.8 | 6.0 | $0.385 | 2/2 | 3.26s |