Classement Tâches agentiques
Voyez quels modèles d'IA réussissent le mieux sur Tâches agentiques, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Tests corrects ↑.
380/380
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Tâches agentiques | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #215 | Gemini 3.1 Flash Lite Preview low | 5.0 | 6.3 | $0.736 | 0/1 | 71.3s | |
| #216 | Gemini 3.1 Flash Lite low | 5.0 | 6.3 | $0.717 | 0/1 | 80.0s | |
| #217 | Solar Pro 4 high | Upstage | 2.8 | 6.3 | $0.164 | 0/1 | 312.3s |
| #218 | Qwen3.5 Plus 2026-02-15 none | Qwen | 5.2 | 6.3 | $0.176 | 0/1 | 183.5s |
| #219 | Claude Opus 4.6 medium | Anthropic | 0.0 | 6.3 | $2.961 | 0/0 | 0ms |
| #220 | Space Bunny Alpha medium | Stealth | 6.1 | 6.3 | $0.000 | 0/1 | 153.1s |
| #221 | DeepSeek V3.2 medium | DeepSeek | 3.0 | 6.3 | $0.145 | 0/1 | 106.3s |
| #222 | Trinity Large Thinking low | Arcee AI | 7.4 | 6.3 | $0.700 | 0/1 | 63.2s |
| #224 | Grok 4.20 medium | X AI | 3.0 | 6.3 | $1.582 | 0/1 | 128.3s |
| #225 | Space Bunny Alpha xhigh | Stealth | 5.2 | 6.2 | $0.000 | 0/1 | 159.1s |
| #226 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 3.0 | 6.2 | $0.478 | 0/1 | 3.38s |
| #227 | GLM 5 Turbo medium | Z.ai | 0.0 | 6.2 | $0.323 | 0/0 | 0ms |
| #229 | Gemini 3.1 Flash Lite Preview none | 5.0 | 6.2 | $0.090 | 0/1 | 48.6s | |
| #230 | Claude Fable 5.1 low | Anthropic | 2.8 | 6.2 | $3.395 | 0/1 | 34.8s |
| #231 | Gemini 3.5 Flash none | 2.8 | 6.1 | $1.752 | 0/1 | 85.3s |