Classement Tâches agentiques
Voyez quels modèles d'IA réussissent le mieux sur Tâches agentiques, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Coût total ↓.
380/380
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Tâches agentiques | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #153 | GPT-5.2 Chat none | OpenAI | 3.0 | 7.0 | $0.594 | 0/1 | 955ms |
| #145 | LongCat 2.0 medium | Meituan | 6.1 | 7.2 | $0.593 | 0/1 | 174.1s |
| #56 | MiMo-V2.6-Pro medium | Xiaomi | 10.0 | 8.7 | $0.586 | 1/1 | 161.4s |
| #74 | DeepSeek V4 Flash 0731 high | DeepSeek | 10.0 | 8.4 | $0.578 | 1/1 | 204.4s |
| #106 | Step 3.7 Flash medium | Stepfun | 7.4 | 7.8 | $0.571 | 0/1 | 93.9s |
| #136 | LongCat 2.0 high | Meituan | 10.0 | 7.3 | $0.569 | 1/1 | 116.1s |
| #140 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 6.1 | 7.2 | $0.567 | 0/1 | 186.4s |
| #87 | DeepSeek V4 Pro 0423 high | DeepSeek | 10.0 | 8.1 | $0.556 | 1/1 | 64.5s |
| #172 | GPT-6 Sol none | OpenAI | 5.0 | 6.8 | $0.551 | 0/1 | 57.0s |
| #367 | Grok Build 0.1 none | X AI | 0.0 | 3.2 | $0.547 | 0/0 | 0ms |
| #130 | Inkling medium | Thinkingmachines | 4.7 | 7.4 | $0.540 | 0/1 | 45.9s |
| #182 | GPT 5.3 Chat none | OpenAI | 3.0 | 6.7 | $0.533 | 0/1 | 955ms |
| #11 | GPT-6.1 Sol medium | OpenAI | 10.0 | 9.6 | $0.530 | 1/1 | 51.0s |
| #249 | GPT-5.6 Terra none | OpenAI | 5.0 | 5.8 | $0.516 | 0/1 | 58.0s |
| #207 | Gemini 3.5 Flash minimal | 5.0 | 6.4 | $0.508 | 0/1 | 49.2s |