Classement Programmation
Voyez quels modèles d'IA réussissent le mieux sur Programmation, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Temps de réponse (moy.) ↓.
289/289
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Programmation | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #74 | Claude Opus 4.6 medium | Anthropic | 5.7 | 7.7 | $2.961 | 1/3 | 30.1s |
| #35 | Qwen3.8 Max low | Qwen | 8.4 | 8.6 | $0.702 | 2/3 | 28.7s |
| #215 | Hy3 preview low | Tencent | 5.3 | 5.5 | $0.042 | 1/3 | 27.9s |
| #49 | GPT-5 Mini medium | OpenAI | 10.0 | 8.1 | $0.241 | 3/3 | 27.6s |
| #60 | Step 3.7 Flash medium | Stepfun | 8.8 | 7.9 | $0.495 | 2/3 | 27.4s |
| #253 | Grok 4.20 Multi Agent Beta medium | X AI | 3.3 | 4.8 | $5.599 | 1/1 | 27.1s |
| #80 | Nemotron 3 Ultra medium | NVIDIA | 8.4 | 7.6 | $0.780 | 2/3 | 26.5s |
| #1 | Gemini 3.6 Flash high | 10.0 | 9.9 | $0.699 | 3/3 | 26.3s | |
| #56 | Inkling medium | Thinkingmachines | 8.4 | 8.0 | $0.377 | 2/3 | 25.2s |
| #100 | KAT-Coder-Pro V2.5 low | Kwaipilot | 7.8 | 7.3 | $0.400 | 2/3 | 24.9s |
| #223 | Kimi K2.5 none | Moonshot AI | 5.5 | 5.4 | $0.101 | 1/3 | 24.6s |
| #258 | Grok 4.1 Fast medium | X AI | 7.8 | 4.7 | $0.069 | 0/1 | 23.6s |
| #212 | KAT-Coder-Air V2.5 medium | Kwaipilot | 3.6 | 5.6 | $0.048 | 0/3 | 23.4s |
| #6 | Gemini 3.5 Flash high | 10.0 | 9.4 | $2.011 | 3/3 | 23.0s | |
| #52 | Muse Spark 1.1 high | Meta | 10.0 | 8.0 | $1.709 | 3/3 | 22.9s |