Classement Suivi des instructions
Voyez quels modèles d'IA réussissent le mieux sur Suivi des instructions, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Temps de réponse (moy.) ↑.
210/210
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Suivi des instructions | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #188 | Cobuddy medium | Baidu | 9.8 | 4.7 | $0.000 | 2/2 | 11.6s |
| #108 | Ring-2.6-1T medium | Inclusionai | 9.8 | 6.3 | $0.103 | 2/2 | 11.8s |
| #48 | Grok Build 0.1 medium | X AI | 9.8 | 7.6 | $1.097 | 2/2 | 12.4s |
| #68 | Kimi K2.6 medium | Moonshot AI | 10.0 | 7.2 | $1.036 | 2/2 | 12.5s |
| #110 | Gemma 4 31B medium | 10.0 | 6.3 | $0.163 | 2/2 | 12.8s | |
| #172 | MiniMax M2.7 medium | Minimax | 3.8 | 5.0 | $0.163 | 0/2 | 12.8s |
| #199 | Hy3 preview none | Tencent | 6.3 | 4.0 | $0.003 | 1/2 | 13.0s |
| #45 | DeepSeek V4 Flash high | DeepSeek | 10.0 | 7.7 | $0.042 | 2/2 | 15.4s |
| #137 | North Mini Code medium | Cohere | 9.8 | 5.9 | $0.000 | 2/2 | 15.4s |
| #128 | GPT-5 Nano medium | OpenAI | 9.8 | 6.1 | $0.114 | 2/2 | 15.6s |
| #153 | Hy3 preview low | Tencent | 10.0 | 5.5 | $0.015 | 2/2 | 16.0s |
| #36 | Qwen3.7 Plus medium | Qwen | 10.0 | 7.9 | $0.267 | 2/2 | 16.1s |
| #80 | Seed-2.0-Mini medium | Bytedance Seed | 10.0 | 7.0 | $0.101 | 2/2 | 17.5s |
| #95 | Gemma 4 26B A4B medium | 10.0 | 6.6 | $0.089 | 2/2 | 17.5s | |
| #150 | DeepSeek V4 Flash none | DeepSeek | 6.5 | 5.6 | $0.044 | 1/2 | 17.5s |