Classement Programmation
Voyez quels modèles d'IA réussissent le mieux sur Programmation, lesquels restent fiables et où les écarts sont les plus marqués. Trier par: Métrique ↑.
Modèles affichés
15
Moyenne de Score Programmation
0.6
Meilleur modèle
Gemini 3.1 Flash Lite Preview 0.0
404/404
Filtrer les modèles
Aucun modèle ne correspond à la recherche et aux filtres actuels.
| Rang | Modèle | Entreprise | Score Programmation | Score | Coût total | Tests corrects | Temps de réponse (moy.) |
|---|---|---|---|---|---|---|---|
| #357 | Mercury 2 none | Inception | 0.3 | 0.4 | $0.033 | 0/3 | 1.03s |
| #204 | Claude Sonnet 5.5 medium | Anthropic | 0.3 | 0.7 | $1.100 | 0/3 | 6.07s |
| #336 | Laguna S 2.1 none | Poolside | 0.3 | 0.5 | $0.044 | 0/3 | 550ms |
| #243 | Claude Fable 5.1 low | Anthropic | 0.3 | 0.6 | $3.395 | 0/3 | 6.75s |
| #359 | MiniMax M2.5 medium | Minimax | 0.3 | 0.4 | $0.440 | 0/3 | 188.6s |
| #320 | KAT Coder AIR V2.5 low | Kwaipilot | 0.3 | 0.5 | $0.046 | 0/3 | 11.1s |
| #322 | Inkling Small none | Thinkingmachines | 0.4 | 0.5 | $0.054 | 0/3 | 759ms |
| #288 | Seed-2.0-Code none | Bytedance Seed | 0.4 | 0.5 | $0.257 | 0/3 | 13.4s |
| #312 | KAT Coder AIR V2.5 medium | Kwaipilot | 0.4 | 0.5 | $0.048 | 0/3 | 23.4s |
| #354 | Trinity Large Preview default | Arcee AI | 0.4 | 0.4 | $0.008 | 0/3 | 14.3s |
| #213 | Qwen3.5-122B-A10B none | Qwen | 0.4 | 0.6 | $0.308 | 0/3 | 2.77s |
| #363 | Mercury 2.5 none | Inception | 0.4 | 0.4 | $0.026 | 0/3 | 12.5s |
| #269 | Trinity Large Thinking high | Arcee AI | 0.4 | 0.6 | $0.794 | 0/3 | 245.0s |
| #198 | GLM 5.2 none | Z.ai | 0.4 | 0.7 | $0.250 | 0/3 | 7.55s |
| #310 | Mistral Small 4 none | Mistral | 0.4 | 0.5 | $0.047 | 0/3 | 901ms |