Classement Programmation
Voyez quels modèles d'IA réussissent le mieux sur Programmation, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Tests corrects ↓.
404/404
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Programmation | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #229 | Solar Pro 4 high | Upstage | 0.6 | 0.6 | $0.077 | 1/3 | 244.7s |
| #231 | Ling 3.1 Flash low | Inclusionai | 0.6 | 0.6 | $0.000 | 1/3 | 107.3s |
| #232 | Claude Opus 4.6 medium | Anthropic | 0.6 | 0.6 | $2.961 | 1/3 | 30.1s |
| #233 | Space Bunny Alpha medium | Stealth | 0.5 | 0.6 | $0.000 | 1/3 | 6.82s |
| #234 | DeepSeek V3.2 medium | DeepSeek | 0.6 | 0.6 | $0.152 | 1/3 | 248.7s |
| #235 | Trinity Large Thinking low | Arcee AI | 0.5 | 0.6 | $0.918 | 1/3 | 344.4s |
| #237 | Grok 4.20 medium | X AI | 0.6 | 0.6 | $1.246 | 1/3 | 109.9s |
| #238 | Space Bunny Alpha xhigh | Stealth | 0.7 | 0.6 | $0.000 | 1/3 | 10.6s |
| #242 | Gemini 3.1 Flash Lite Preview none | 0.5 | 0.6 | $0.090 | 1/3 | 967ms | |
| #249 | Granite 4.2 8B medium | IBM Granite | 0.5 | 0.6 | $0.029 | 1/3 | 12.1s |
| #250 | KAT-Coder-Pro V2.5 default | Kwaipilot | 0.6 | 0.6 | $0.742 | 1/3 | 22.5s |
| #252 | Claude Sonnet 4.6 none | Anthropic | 0.5 | 0.6 | $0.661 | 1/3 | 5.19s |
| #253 | GLM 5.3 FlashX low | Z.ai | 0.5 | 0.6 | $0.157 | 1/3 | 5.45s |
| #254 | MiMo-V2.6-Pro none | Xiaomi | 0.6 | 0.6 | $0.193 | 1/3 | 3.69s |
| #256 | Seed-2.0-Lite none | Bytedance Seed | 0.6 | 0.6 | $0.114 | 1/3 | 2.83s |