Classement Programmation
Voyez quels modèles d'IA réussissent le mieux sur Programmation, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Tests corrects ↑.
408/408
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Programmation | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #238 | Grok 4.20 medium | X AI | 0.6 | 0.6 | $1.246 | 1/3 | 109.9s |
| #239 | Space Bunny Alpha xhigh | Stealth | 0.7 | 0.6 | $0.000 | 1/3 | 10.6s |
| #243 | Gemini 3.1 Flash Lite Preview none | 0.5 | 0.6 | $0.090 | 1/3 | 967ms | |
| #251 | Granite 4.2 8B medium | IBM Granite | 0.5 | 0.6 | $0.029 | 1/3 | 12.1s |
| #252 | KAT-Coder-Pro V2.5 default | Kwaipilot | 0.6 | 0.6 | $0.742 | 1/3 | 22.5s |
| #254 | Claude Sonnet 4.6 none | Anthropic | 0.5 | 0.6 | $0.661 | 1/3 | 5.19s |
| #255 | GLM 5.3 FlashX low | Z.ai | 0.5 | 0.6 | $0.157 | 1/3 | 5.45s |
| #256 | MiMo-V2.6-Pro none | Xiaomi | 0.6 | 0.6 | $0.193 | 1/3 | 3.69s |
| #258 | Seed-2.0-Lite none | Bytedance Seed | 0.6 | 0.6 | $0.114 | 1/3 | 2.83s |
| #259 | Gemini 3.1 Flash Lite minimal | 0.5 | 0.6 | $0.080 | 1/3 | 831ms | |
| #260 | gpt-oss-120b medium | OpenAI | 0.6 | 0.6 | $0.030 | 1/3 | 38.4s |
| #261 | Gemini 3.1 Flash Lite none | 0.5 | 0.6 | $0.069 | 1/3 | 938ms | |
| #262 | Qwen3.6 Flash none | Qwen | 0.5 | 0.6 | $0.139 | 1/3 | 1.79s |
| #264 | Nemotron 3 Ultra none | NVIDIA | 0.5 | 0.6 | $0.164 | 1/3 | 1.02s |
| #265 | Qwen3.7 Flash none | Qwen | 0.5 | 0.6 | $0.028 | 1/3 | 1.55s |