Classement Programmation
Voyez quels modèles d'IA réussissent le mieux sur Programmation, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Tests corrects ↑.
404/404
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Programmation | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #34 | GPT-5.3-Codex medium | OpenAI | 1.0 | 0.9 | $1.318 | 3/3 | 19.5s |
| #35 | Claude Haiku 5.5 xhigh | Anthropic | 1.0 | 0.9 | $0.140 | 3/3 | 13.1s |
| #36 | Muse Spark 1.3 high | Meta | 1.0 | 0.9 | $1.891 | 3/3 | 51.7s |
| #37 | Pareto default | Unbiased | 1.0 | 0.9 | $1.520 | 3/3 | 50.1s |
| #38 | Seed 2.1 Turbo high | Bytedance Seed | 1.0 | 0.9 | $1.892 | 3/3 | 336.0s |
| #41 | Muse Spark 1.3 medium | Meta | 1.0 | 0.9 | $1.712 | 3/3 | 41.1s |
| #45 | GLM 5.3 Flash max | Z.ai | 1.0 | 0.9 | $0.089 | 3/3 | 43.4s |
| #46 | Muse Spark 1.2 high | Meta | 1.0 | 0.9 | $2.018 | 3/3 | 22.2s |
| #47 | Muse Spark 1.2 medium | Meta | 1.0 | 0.9 | $1.590 | 3/3 | 17.5s |
| #48 | Muse Spark 1.1 medium | Meta | 1.0 | 0.9 | $1.665 | 3/3 | 15.7s |
| #49 | Claude Fable 5 medium | Anthropic | 1.0 | 0.9 | $5.089 | 3/3 | 15.6s |
| #52 | DeepSeek V4.1 Flash high | DeepSeek | 1.0 | 0.9 | $0.617 | 3/3 | 49.2s |
| #53 | DeepSeek V4.1 Flash medium | DeepSeek | 1.0 | 0.9 | $0.591 | 3/3 | 34.4s |
| #55 | GPT-5.2 medium | OpenAI | 1.0 | 0.9 | $1.558 | 3/3 | 22.7s |
| #60 | DeepSeek V4.1 Flash max | DeepSeek | 1.0 | 0.9 | $1.204 | 3/3 | 62.5s |