Classement Programmation
Voyez quels modèles d'IA réussissent le mieux sur Programmation, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Tests corrects ↑.
289/289
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Programmation | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #113 | Step 3.7 Flash low | Stepfun | 8.2 | 7.1 | $0.390 | 2/3 | 9.46s |
| #120 | Mercury 2 medium | Inception | 8.2 | 7.0 | $0.094 | 2/3 | 2.04s |
| #124 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 7.8 | 6.9 | $0.478 | 2/3 | 33.1s |
| #127 | Gemini 3.5 Flash none | 8.8 | 6.9 | $1.093 | 2/3 | 34.7s | |
| #130 | Seed-2.0-Code medium | Bytedance Seed | 8.9 | 6.8 | $1.153 | 2/3 | 89.9s |
| #143 | LongCat 2.0 high | Meituan | 7.8 | 6.7 | $0.492 | 2/3 | 505.3s |
| #148 | Inkling Small medium | Thinkingmachines | 7.8 | 6.6 | $0.113 | 2/3 | 10.5s |
| #150 | Qwen3.6 35B A3B medium | Qwen | 7.7 | 6.6 | $0.749 | 2/3 | 50.5s |
| #152 | Qwen3.6 27B medium | Qwen | 7.7 | 6.5 | $1.045 | 2/3 | 143.0s |
| #176 | Trinity Large Thinking medium | Arcee AI | 7.5 | 6.1 | $0.798 | 2/3 | 179.0s |
| #1 | Gemini 3.6 Flash high | 10.0 | 9.9 | $0.699 | 3/3 | 26.3s | |
| #2 | Gemini 3.7 Flash high | 10.0 | 9.8 | $0.323 | 3/3 | 13.6s | |
| #3 | Gemini 3.6 Flash medium | 10.0 | 9.8 | $0.427 | 3/3 | 14.8s | |
| #4 | GPT-5.6 Sol low | OpenAI | 10.0 | 9.5 | $0.496 | 3/3 | 11.3s |
| #6 | Gemini 3.5 Flash high | 10.0 | 9.4 | $2.011 | 3/3 | 23.0s |