Classement Tâches agentiques
Voyez quels modèles d'IA réussissent le mieux sur Tâches agentiques, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Tests corrects ↓.
380/380
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Tâches agentiques | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #68 | Qwen3.8 2.4T A95B low | Qwen | 10.0 | 8.4 | $3.172 | 1/1 | 151.8s |
| #69 | GPT-5 Mini medium | OpenAI | 10.0 | 8.4 | $0.293 | 1/1 | 68.5s |
| #70 | Muse Glimmer 30B xhigh | Meta | 10.0 | 8.4 | $0.724 | 1/1 | 145.1s |
| #72 | Inkling high | Thinkingmachines | 10.0 | 8.4 | $1.250 | 1/1 | 66.0s |
| #73 | Muse Spark 1.1 high | Meta | 10.0 | 8.4 | $2.570 | 1/1 | 49.7s |
| #74 | DeepSeek V4 Flash 0731 high | DeepSeek | 10.0 | 8.4 | $0.578 | 1/1 | 204.4s |
| #75 | GLM 5.2 high | Z.ai | 10.0 | 8.4 | $1.620 | 1/1 | 52.4s |
| #76 | GPT-5.6 Terra high | OpenAI | 10.0 | 8.3 | $1.116 | 1/1 | 66.4s |
| #77 | Kimi K3 max | Moonshot AI | 10.0 | 8.3 | $4.013 | 1/1 | 74.2s |
| #79 | Qwen3.7 Plus medium | Qwen | 10.0 | 8.3 | $0.432 | 1/1 | 196.5s |
| #81 | GLM 5.2 medium | Z.ai | 10.0 | 8.2 | $0.398 | 1/1 | 102.4s |
| #82 | GPT-5.6 Terra medium | OpenAI | 10.0 | 8.2 | $0.744 | 1/1 | 54.7s |
| #83 | Seed-2.0-Lite medium | Bytedance Seed | 10.0 | 8.2 | $0.271 | 1/1 | 69.3s |
| #84 | Seed-2.0-Code low | Bytedance Seed | 10.0 | 8.1 | $0.881 | 1/1 | 90.2s |
| #86 | DeepSeek V4 Pro 0423 high | DeepSeek | 10.0 | 8.1 | $0.556 | 1/1 | 64.5s |