Classement Programmation
Voyez quels modèles d'IA réussissent le mieux sur Programmation, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Métrique ↑.
Modèles affichés
15
Moyenne de Score Programmation
0.6
Meilleur modèle
Gemini 3.1 Flash Lite Preview 0.0
404/404
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Programmation | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #271 | GPT-5.4 Mini none | OpenAI | 0.5 | 0.6 | $0.170 | 1/3 | 913ms |
| #275 | Gemma 4 31B none | 0.5 | 0.6 | $0.031 | 1/3 | 11.2s | |
| #277 | GPT-5.4 none | OpenAI | 0.5 | 0.6 | $0.690 | 1/3 | 1.62s |
| #278 | Solar Pro 4 none | Upstage | 0.5 | 0.6 | $0.022 | 1/3 | 2.61s |
| #280 | Qwen3.5-35B-A3B none | Qwen | 0.5 | 0.6 | $0.120 | 1/3 | 1.39s |
| #284 | Gemini 2.5 Flash none | 0.5 | 0.5 | $0.017 | 1/3 | 736ms | |
| #285 | GPT-6 Luna none | OpenAI | 0.5 | 0.5 | $0.026 | 1/3 | 8.04s |
| #290 | Qwen3.8 27B none | Qwen | 0.5 | 0.5 | ~$0.010 | 1/3 | 1.19s |
| #295 | Ember-1 none | Fireworks | 0.5 | 0.5 | $0.786 | 1/3 | 1.94s |
| #298 | Granite 4.2 8B low | IBM Granite | 0.5 | 0.5 | $0.036 | 1/3 | 13.0s |
| #299 | Kimi K2.5 none | Moonshot AI | 0.5 | 0.5 | $0.262 | 1/3 | 24.6s |
| #302 | Qwen3.6 35B A3B none | Qwen | 0.5 | 0.5 | $0.105 | 1/3 | 8.77s |
| #304 | Ling 3.0 Flash none | Inclusionai | 0.5 | 0.5 | $0.004 | 1/3 | 6.39s |
| #311 | Mercury 2.5 low | Inception | 0.5 | 0.5 | $0.020 | 1/3 | 972ms |
| #316 | Mercury 2.5 Preview low | Inception | 0.5 | 0.5 | $0.015 | 1/3 | 972ms |