Classement Programmation
Voyez quels modèles d'IA réussissent le mieux sur Programmation, lesquels restent fiables et où les écarts sont les plus marqués.
404/404
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Programmation | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #254 | MiMo-V2.6-Pro none | Xiaomi | 0.6 | 0.6 | $0.193 | 1/3 | 3.69s |
| #139 | DeepSeek V4 Pro 0423 none | DeepSeek | 0.6 | 0.7 | $0.083 | 1/3 | 13.4s |
| #256 | Seed-2.0-Lite none | Bytedance Seed | 0.6 | 0.6 | $0.114 | 1/3 | 2.83s |
| #193 | GPT 5.3 Chat default | OpenAI | 0.6 | 0.7 | $0.533 | 1/3 | 10.5s |
| #276 | Space Bunny Alpha low | Stealth | 0.6 | 0.6 | $0.000 | 1/3 | 6.60s |
| #170 | Grok 4.6 low | X AI | 0.6 | 0.7 | $0.781 | 1/3 | 21.7s |
| #129 | Seed-2.0-Mini medium | Bytedance Seed | 0.6 | 0.8 | $0.140 | 1/3 | 220.5s |
| #266 | DeepSeek V4.1 Flash none | DeepSeek | 0.6 | 0.6 | $0.391 | 1/3 | 83.7s |
| #282 | Kimi K2.6 none | Moonshot AI | 0.6 | 0.5 | $0.486 | 1/3 | 82.6s |
| #195 | Apodex 1.1 Mini high | Apodex | 0.6 | 0.7 | $0.000 | 0/3 | 47.0s |
| #106 | Qwen3.7 Max none | Qwen | 0.5 | 0.8 | $0.451 | 1/3 | 1.35s |
| #115 | Qwen3.7 Plus none | Qwen | 0.5 | 0.8 | $0.178 | 1/3 | 2.15s |
| #166 | Gemini 3.1 Flash Lite Preview medium | 0.5 | 0.7 | $0.158 | 1/3 | 4.09s | |
| #173 | Gemini 3.1 Flash Lite medium | 0.5 | 0.7 | $0.153 | 1/3 | 3.81s | |
| #176 | GPT-5.6 Luna low | OpenAI | 0.5 | 0.7 | $0.049 | 1/3 | 4.61s |