Classement Programmation
Voyez quels modèles d'IA réussissent le mieux sur Programmation, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Coût total ↓.
Modèles affichés
15
Moyenne de Score Programmation
6.1
Meilleur modèle
Grok 4.20 Multi Agent Beta 3.3
289/289
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Programmation | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #224 | DeepSeek V4 Flash 0731 none | DeepSeek | 4.3 | 5.4 | $0.021 | 0/3 | 1.72s |
| #217 | Mimo V2 Omni none | Xiaomi | 4.4 | 5.5 | $0.021 | 0/3 | 2.75s |
| #161 | Ling-3.0-flash high | Inclusionai | 6.7 | 6.4 | $0.021 | 1/3 | 14.9s |
| #239 | Qwen3.5-9B none | Qwen | 3.9 | 5.1 | $0.021 | 0/3 | 5.60s |
| #288 | Step 3.5 Flash none | Stepfun | 9.8 | 2.3 | $0.020 | 0/1 | 0ms |
| #172 | Qwen3.7 Flash none | Qwen | 5.5 | 6.1 | $0.019 | 1/3 | 1.55s |
| #171 | gpt-oss-120b medium | OpenAI | 5.9 | 6.1 | $0.019 | 1/3 | 38.4s |
| #182 | Gemini 2.5 Flash none | 5.5 | 6.0 | $0.017 | 1/3 | 736ms | |
| #178 | Gemma 4 31B none | 5.5 | 6.1 | $0.016 | 1/3 | 11.2s | |
| #255 | GLM 4.7 Flash none | Z.ai | 4.3 | 4.8 | $0.016 | 0/3 | 2.54s |
| #229 | Ling-2.6-1T none | Inclusionai | 3.8 | 5.3 | $0.016 | 0/3 | 10.6s |
| #272 | Laguna Xs.2 medium | Poolside | 2.1 | 4.1 | $0.015 | 0/1 | 14.4s |
| #209 | Gemma 4 26B A4B none | 3.7 | 5.6 | $0.015 | 0/3 | 4.16s | |
| #245 | GPT-4o-mini none | OpenAI | 3.2 | 5.0 | $0.010 | 0/3 | 1.63s |
| #285 | gpt-oss-120b none | OpenAI | 1.5 | 3.7 | $0.010 | 0/1 | 9.57s |