Classement Suivi des instructions
Voyez quels modèles d'IA réussissent le mieux sur Suivi des instructions, lesquels restent fiables et où les écarts sont les plus marqués.
Modèles affichés
15
Moyenne de Score Suivi des instructions
8.6
Meilleur modèle
Gemini 3 Flash Preview 10.0
216/216
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Suivi des instructions | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #138 | GPT-5.6 Terra none | OpenAI | 8.5 | 6.0 | $0.349 | 1/2 | 1.15s |
| #31 | Gemini 3.5 Flash-Lite high | 8.5 | 8.1 | $0.584 | 1/2 | 1.87s | |
| #123 | GPT-5.6 Luna low | OpenAI | 8.5 | 6.2 | $0.249 | 1/2 | 2.04s |
| #136 | Step 3.5 Flash medium | Stepfun | 8.3 | 6.0 | $0.108 | 1/2 | 4.78s |
| #140 | Mimo V2 Omni medium | Xiaomi | 8.3 | 5.9 | $0.683 | 1/2 | 4.99s |
| #50 | DeepSeek V4 Pro high | DeepSeek | 7.8 | 7.7 | $0.200 | 1/2 | 8.73s |
| #196 | MiniMax M2.5 medium | Minimax | 7.5 | 4.6 | $0.340 | 1/2 | 621ms |
| #149 | Gemini 3.1 Flash Lite high | 7.3 | 5.6 | $2.044 | 1/2 | 23.3s | |
| #173 | Mistral Small 4 medium | Mistral | 7.3 | 5.1 | $0.096 | 1/2 | 1.38s |
| #27 | Muse Spark 1.1 low | Meta | 7.3 | 8.3 | $0.647 | 1/2 | 5.42s |
| #146 | Nemotron 3 Super medium | NVIDIA | 7.3 | 5.7 | $0.055 | 1/2 | 6.97s |
| #213 | Nemotron 3 Nano Omni 30b A3b Reasoning medium | NVIDIA | 7.3 | 3.4 | $0.000 | 1/2 | 1.37s |
| #165 | GPT-5.6 Luna none | OpenAI | 7.1 | 5.4 | $0.142 | 1/2 | 1.23s |
| #19 | Muse Spark 1.1 medium | Meta | 6.5 | 8.6 | $1.357 | 1/2 | 6.31s |
| #64 | LongCat 2.0 medium | Meituan | 6.5 | 7.4 | $0.478 | 1/2 | 7.38s |