Classement Programmation
Voyez quels modèles d'IA réussissent le mieux sur Programmation, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Métrique ↑.
Modèles affichés
15
Moyenne de Score Programmation
0.6
Meilleur modèle
Gemini 3.1 Flash Lite Preview 0.0
404/404
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Programmation | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #67 | Muse Spark 1.3 low | Meta | 0.8 | 0.9 | $0.911 | 2/3 | 20.9s |
| #88 | GLM 5.2 medium | Z.ai | 0.8 | 0.8 | $1.007 | 2/3 | 41.0s |
| #103 | GLM 5.3 FlashX max | Z.ai | 0.8 | 0.8 | $0.623 | 2/3 | 24.6s |
| #110 | Ling 3.1 Flash high | Inclusionai | 0.8 | 0.8 | $0.000 | 2/3 | 83.4s |
| #114 | Grok 4.6 medium | X AI | 0.8 | 0.8 | $2.270 | 2/3 | 120.0s |
| #136 | GLM 5.3 FlashX high | Z.ai | 0.8 | 0.7 | $0.210 | 2/3 | 8.06s |
| #142 | GLM 5.3 Flash high | Z.ai | 0.8 | 0.7 | $0.056 | 2/3 | 19.6s |
| #157 | Step 3.7 Flash low | Stepfun | 0.8 | 0.7 | $0.449 | 2/3 | 9.46s |
| #174 | Ember-1 high | Fireworks | 0.8 | 0.7 | $2.405 | 2/3 | 72.2s |
| #154 | Qwen3.7 Flash high | Qwen | 0.8 | 0.7 | $0.063 | 2/3 | 58.8s |
| #389 | Laguna Xs.2 default | Poolside | 0.8 | 0.3 | $0.004 | 0/1 | 1.96s |
| #17 | Gemini 3.7 Flash medium | 0.8 | 1.0 | $0.278 | 2/3 | 8.86s | |
| #29 | Claude Opus 5.5 medium | Anthropic | 0.8 | 0.9 | $1.804 | 2/3 | 13.5s |
| #40 | Qwen3.8 Max (0902) medium | Qwen | 0.8 | 0.9 | $1.096 | 2/3 | 45.7s |
| #42 | Gemini 3.5 Flash Lite high | 0.8 | 0.9 | $0.624 | 2/3 | 16.6s |