Classement Tâches agentiques
Voyez quels modèles d'IA réussissent le mieux sur Tâches agentiques, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Tests corrects ↑.
387/387
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Tâches agentiques | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #340 | Granite 4.2 8B none | IBM Granite | 0.5 | 0.4 | $0.037 | 0/1 | 49.2s |
| #341 | Cobuddy medium | Baidu | 0.3 | 0.4 | $0.000 | 0/1 | 173ms |
| #342 | Mercury 2 none | Inception | 0.3 | 0.4 | $0.033 | 0/1 | 9.00s |
| #343 | Gemini 3.1 Flash Lite Preview high | 0.0 | 0.4 | $2.310 | 0/0 | 0ms | |
| #344 | MiniMax M2.5 medium | Minimax | 0.3 | 0.4 | $0.440 | 0/1 | 600.8s |
| #345 | GLM 4.7 Flash medium | Z.ai | 0.4 | 0.4 | $0.193 | 0/1 | 399.2s |
| #346 | gpt-oss-120b none | OpenAI | 0.6 | 0.4 | $0.016 | 0/1 | 140.9s |
| #347 | GLM 5 Turbo none | Z.ai | 0.0 | 0.4 | $0.047 | 0/0 | 0ms |
| #348 | Mercury 2.5 none | Inception | 0.5 | 0.4 | $0.026 | 0/1 | 63.4s |
| #349 | Qwen3.6 Plus Preview medium | Qwen | 0.0 | 0.4 | $0.000 | 0/0 | 0ms |
| #350 | Qwen3.5-9B medium | Qwen | 0.5 | 0.4 | $0.106 | 0/1 | 152.9s |
| #351 | Grok 4.20 Multi Agent Beta medium | X AI | 0.0 | 0.4 | $5.599 | 0/0 | 0ms |
| #352 | Hunter Alpha medium | OpenRouter | 0.0 | 0.4 | $0.000 | 0/0 | 0ms |
| #353 | Grok 4.1 Fast medium | X AI | 0.0 | 0.4 | $0.069 | 0/0 | 0ms |
| #354 | Laguna M.1 medium | Poolside | 0.0 | 0.4 | $0.033 | 0/0 | 0ms |