Classement Programmation
Voyez quels modèles d'IA réussissent le mieux sur Programmation, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Coût total ↓.
408/408
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Programmation | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #332 | Hy4 preview none | Tencent | 0.4 | 0.5 | $0.165 | 0/3 | 45.5s |
| #264 | Nemotron 3 Ultra none | NVIDIA | 0.5 | 0.6 | $0.164 | 1/3 | 1.02s |
| #272 | GPT-5 Nano medium | OpenAI | 0.7 | 0.6 | $0.159 | 1/3 | 41.6s |
| #166 | Gemini 3.1 Flash Lite Preview medium | 0.5 | 0.7 | $0.158 | 1/3 | 4.09s | |
| #255 | GLM 5.3 FlashX low | Z.ai | 0.5 | 0.6 | $0.157 | 1/3 | 5.45s |
| #215 | Gemini 3 Flash Preview none | 0.5 | 0.6 | $0.155 | 1/3 | 1.80s | |
| #174 | Gemini 3.1 Flash Lite medium | 0.5 | 0.7 | $0.153 | 1/3 | 3.81s | |
| #235 | DeepSeek V3.2 medium | DeepSeek | 0.6 | 0.6 | $0.152 | 1/3 | 248.7s |
| #237 | DeepSeek V4 Flash 0423 none | DeepSeek | 0.4 | 0.6 | $0.149 | 0/3 | 17.1s |
| #92 | DeepSeek V4 Pro 0423 high | DeepSeek | 0.6 | 0.8 | $0.149 | 1/3 | 243.0s |
| #226 | Qwen3.6 27B none | Qwen | 0.5 | 0.6 | $0.148 | 1/3 | 4.16s |
| #327 | Laguna S 2.1 high | Poolside | 0.5 | 0.5 | $0.145 | 1/3 | 271.4s |
| #176 | Gemma 4 31B medium | 0.4 | 0.7 | $0.144 | 0/3 | 219.8s | |
| #129 | Seed-2.0-Mini medium | Bytedance Seed | 0.6 | 0.8 | $0.140 | 1/3 | 220.5s |
| #282 | GLM 5 none | Z.ai | 0.4 | 0.6 | $0.140 | 0/3 | 5.12s |