Classement Tâches agentiques
Voyez quels modèles d'IA réussissent le mieux sur Tâches agentiques, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Coût total ↓.
380/380
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Tâches agentiques | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #160 | Gemini 3 Flash Preview low | 5.0 | 6.9 | $0.254 | 0/1 | 52.6s | |
| #281 | Kimi K2.5 none | Moonshot AI | 5.0 | 5.3 | $0.236 | 0/1 | 321.2s |
| #282 | Qwen3.6 Max Preview none | Qwen | 0.0 | 5.3 | $0.228 | 0/0 | 0ms |
| #234 | Qwen3.5 Plus 2026-04-20 none | Qwen | 6.1 | 6.1 | $0.226 | 0/1 | 137.1s |
| #103 | MiMo-V2.6-Flash medium | Xiaomi | 10.0 | 7.9 | $0.218 | 1/1 | 90.1s |
| #263 | Qwen3.5-35B-A3B none | Qwen | 3.9 | 5.6 | $0.213 | 0/1 | 141.2s |
| #126 | GLM 5.3 FlashX high | Z.ai | 10.0 | 7.4 | $0.210 | 1/1 | 78.0s |
| #91 | GPT-5.6 Luna high | OpenAI | 10.0 | 8.0 | $0.207 | 1/1 | 60.2s |
| #298 | MiniMax M2.7 medium | Minimax | 4.7 | 5.0 | $0.202 | 0/1 | 198.8s |
| #151 | MiMo-V2.6-Flash low | Xiaomi | 4.7 | 7.1 | $0.200 | 0/1 | 107.9s |
| #247 | Nemotron 3 Ultra none | NVIDIA | 5.0 | 5.9 | $0.193 | 0/1 | 70.2s |
| #341 | GLM 4.7 Flash medium | Z.ai | 3.9 | 4.2 | $0.193 | 0/1 | 399.2s |
| #239 | MiMo-V2.6-Pro none | Xiaomi | 5.0 | 6.0 | $0.193 | 0/1 | 66.1s |
| #51 | DeepSeek V4.1 Flash high | DeepSeek | 10.0 | 8.7 | $0.190 | 1/1 | 44.0s |
| #93 | GPT-5.4 Nano medium | OpenAI | 10.0 | 8.0 | $0.187 | 1/1 | 74.0s |