Classement Suivi des instructions
Voyez quels modèles d'IA réussissent le mieux sur Suivi des instructions, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Tests corrects ↓.
Modèles affichés
15
Moyenne de Score Suivi des instructions
8.6
Meilleur modèle
Gemini 3.6 Flash 9.9
216/216
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Suivi des instructions | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #145 | GPT-5.4 none | OpenAI | 6.5 | 5.8 | $0.397 | 1/2 | 1.07s |
| #146 | Nemotron 3 Super medium | NVIDIA | 7.3 | 5.7 | $0.055 | 1/2 | 6.97s |
| #148 | Qwen3.5-122B-A10B none | Qwen | 6.3 | 5.7 | $0.247 | 1/2 | 513ms |
| #149 | Gemini 3.1 Flash Lite high | 7.3 | 5.6 | $2.044 | 1/2 | 23.3s | |
| #151 | GLM 5V Turbo none | Z.ai | 6.5 | 5.6 | $0.052 | 1/2 | 1.97s |
| #152 | Owl Alpha medium | Openrouter | 6.5 | 5.6 | $0.000 | 1/2 | 10.2s |
| #153 | Mimo V2 PRO none | Xiaomi | 6.5 | 5.6 | $0.045 | 1/2 | 2.51s |
| #154 | Owl Alpha none | Openrouter | 6.4 | 5.6 | $0.000 | 1/2 | 2.63s |
| #156 | DeepSeek V4 Flash none | DeepSeek | 6.5 | 5.6 | $0.042 | 1/2 | 17.5s |
| #158 | Qwen3.6 27B none | Qwen | 6.2 | 5.5 | $0.087 | 1/2 | 1.92s |
| #160 | MiMo-V2.5-Pro none | Xiaomi | 6.4 | 5.5 | $0.068 | 1/2 | 1.03s |
| #161 | Kimi K2.5 none | Moonshot AI | 6.5 | 5.5 | $0.127 | 1/2 | 2.67s |
| #162 | Gemma 4 26B A4B none | 6.3 | 5.5 | $0.015 | 1/2 | 690ms | |
| #163 | Mimo V2 Omni none | Xiaomi | 6.5 | 5.5 | $0.021 | 1/2 | 4.26s |
| #165 | GPT-5.6 Luna none | OpenAI | 7.1 | 5.4 | $0.142 | 1/2 | 1.23s |