Classement Programmation
Voyez quels modèles d'IA réussissent le mieux sur Programmation, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Coût total ↓.
404/404
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Programmation | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #107 | Gemini 3.5 Flash medium | 0.8 | 0.8 | $1.316 | 2/3 | 12.6s | |
| #135 | Seed-2.0-Code medium | Bytedance Seed | 0.9 | 0.7 | $1.275 | 2/3 | 89.9s |
| #237 | Grok 4.20 medium | X AI | 0.6 | 0.6 | $1.246 | 1/3 | 109.9s |
| #13 | GPT-5.6 Sol low | OpenAI | 1.0 | 1.0 | $1.244 | 3/3 | 11.3s |
| #75 | Inkling high | Thinkingmachines | 0.9 | 0.8 | $1.238 | 2/3 | 148.4s |
| #197 | GPT-5.5 none | OpenAI | 0.5 | 0.7 | $1.212 | 1/3 | 1.35s |
| #60 | DeepSeek V4.1 Flash max | DeepSeek | 1.0 | 0.9 | $1.204 | 3/3 | 62.5s |
| #32 | Qwen3.8 MAX medium | Qwen | 1.0 | 0.9 | $1.181 | 3/3 | 41.3s |
| #63 | Claude Sonnet 5.5 high | Anthropic | 1.0 | 0.9 | $1.175 | 3/3 | 9.85s |
| #169 | Qwen3.5-122B-A10B medium | Qwen | 0.6 | 0.7 | $1.152 | 1/3 | 114.5s |
| #167 | Kimi K2.7 Code medium | Moonshot AI | 0.8 | 0.7 | $1.136 | 2/3 | 146.7s |
| #102 | Qwen3.5-27B medium | Qwen | 0.6 | 0.8 | $1.135 | 1/3 | 160.7s |
| #165 | Qwen3.6 Max Preview medium | Qwen | 0.9 | 0.7 | $1.132 | 2/3 | 146.5s |
| #65 | Qwen3.8 Max (0902) low | Qwen | 1.0 | 0.9 | $1.131 | 3/3 | 37.4s |
| #105 | GPT-5.4 Mini medium | OpenAI | 0.8 | 0.8 | $1.102 | 2/3 | 57.9s |