Classement Programmation
Voyez quels modèles d'IA réussissent le mieux sur Programmation, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Tests corrects ↓.
404/404
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Programmation | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #37 | Pareto default | Unbiased | 1.0 | 0.9 | $1.520 | 3/3 | 50.1s |
| #38 | Seed 2.1 Turbo high | Bytedance Seed | 1.0 | 0.9 | $1.892 | 3/3 | 336.0s |
| #41 | Muse Spark 1.3 medium | Meta | 1.0 | 0.9 | $1.712 | 3/3 | 41.1s |
| #45 | GLM 5.3 Flash max | Z.ai | 1.0 | 0.9 | $0.089 | 3/3 | 43.4s |
| #46 | Muse Spark 1.2 high | Meta | 1.0 | 0.9 | $2.018 | 3/3 | 22.2s |
| #47 | Muse Spark 1.2 medium | Meta | 1.0 | 0.9 | $1.590 | 3/3 | 17.5s |
| #48 | Muse Spark 1.1 medium | Meta | 1.0 | 0.9 | $1.665 | 3/3 | 15.7s |
| #49 | Claude Fable 5 medium | Anthropic | 1.0 | 0.9 | $5.089 | 3/3 | 15.6s |
| #52 | DeepSeek V4.1 Flash high | DeepSeek | 1.0 | 0.9 | $0.617 | 3/3 | 49.2s |
| #53 | DeepSeek V4.1 Flash medium | DeepSeek | 1.0 | 0.9 | $0.591 | 3/3 | 34.4s |
| #55 | GPT-5.2 medium | OpenAI | 1.0 | 0.9 | $1.558 | 3/3 | 22.7s |
| #60 | DeepSeek V4.1 Flash max | DeepSeek | 1.0 | 0.9 | $1.204 | 3/3 | 62.5s |
| #61 | Muse Spark 1.1 low | Meta | 1.0 | 0.9 | $0.885 | 3/3 | 10.3s |
| #63 | Claude Sonnet 5.5 high | Anthropic | 1.0 | 0.9 | $1.175 | 3/3 | 9.85s |
| #65 | Qwen3.8 Max (0902) low | Qwen | 1.0 | 0.9 | $1.131 | 3/3 | 37.4s |