Classement Suivi des instructions
Voyez quels modèles d'IA réussissent le mieux sur Suivi des instructions, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Temps de réponse (moy.) ↓.
319/319
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Suivi des instructions | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #55 | GPT-5.2 medium | OpenAI | 9.9 | 8.4 | $1.182 | 2/2 | 3.12s |
| #50 | GPT-5.4 medium | OpenAI | 10.0 | 8.5 | $1.560 | 2/2 | 3.11s |
| #309 | Ling 3.0 Tiny high | Inclusionai | 6.8 | 3.8 | $0.000 | 1/2 | 3.10s |
| #63 | Claude Sonnet 5 medium | Anthropic | 9.9 | 8.2 | $0.922 | 2/2 | 3.10s |
| #310 | Ling 3.0 Tiny low | Inclusionai | 6.6 | 3.8 | $0.000 | 1/2 | 3.09s |
| #32 | GPT-5.3-Codex medium | OpenAI | 10.0 | 8.9 | $0.988 | 2/2 | 3.04s |
| #69 | DeepSeek V4 Flash 0731 low | DeepSeek | 9.9 | 8.0 | $0.072 | 2/2 | 3.01s |
| #313 | Ling 3.0 Tiny medium | Inclusionai | 6.8 | 3.8 | $0.000 | 1/2 | 3.00s |
| #297 | GLM 4.7 Flash medium | Z.ai | 6.2 | 4.3 | $0.168 | 1/2 | 2.97s |
| #52 | Muse Spark 1.2 low | Meta | 9.8 | 8.4 | $0.655 | 2/2 | 2.95s |
| #14 | GPT-6 Astra medium | OpenAI | 10.0 | 9.4 | $1.774 | 2/2 | 2.86s |
| #199 | Gemma 4 31B none | 6.5 | 6.1 | $0.016 | 1/2 | 2.84s | |
| #300 | Hunter Alpha none | OpenRouter | 6.4 | 4.2 | $0.000 | 1/2 | 2.82s |
| #180 | LongCat 2.0 none | Meituan | 6.5 | 6.4 | $0.044 | 1/2 | 2.82s |
| #41 | Gemini 3.6 Flash low | 9.8 | 8.7 | $0.251 | 2/2 | 2.82s |