Ranking de Programación
Mira qué modelos de IA rinden mejor en Programación, cuáles se mantienen fiables y dónde aparecen las mayores diferencias.
292/292
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Programación | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #246 | Laguna S 2.1 low | Poolside | 3.8 | 5.0 | $0.082 | 0/3 | 167.5s |
| #232 | Ling-2.6-1T none | Inclusionai | 3.8 | 5.3 | $0.016 | 0/3 | 10.6s |
| #224 | GPT-5.6 Luna none | OpenAI | 3.8 | 5.4 | $0.029 | 0/3 | 980ms |
| #263 | Cobuddy medium | Baidu | 3.7 | 4.7 | $0.000 | 0/3 | 79.2s |
| #176 | Qwen3.5-Flash medium | Qwen | 3.7 | 6.1 | $0.142 | 0/3 | 58.9s |
| #212 | Gemma 4 26B A4B none | 3.7 | 5.6 | $0.015 | 0/3 | 4.16s | |
| #265 | Qwen3 Coder Next medium | Qwen | 3.7 | 4.6 | $0.034 | 0/3 | 924ms |
| #272 | Elephant Alpha medium | Openrouter | 3.7 | 4.3 | $0.000 | 0/3 | 1.30s |
| #140 | GLM 5.2 none | Z.ai | 3.7 | 6.7 | $0.188 | 0/3 | 7.55s |
| #238 | Mistral Small 4 none | Mistral | 3.7 | 5.1 | $0.022 | 0/3 | 901ms |
| #255 | Trinity Large Thinking high | Arcee AI | 3.7 | 4.8 | $0.624 | 0/3 | 245.0s |
| #207 | Qwen3.5-122B-A10B none | Qwen | 3.7 | 5.7 | $0.247 | 0/3 | 2.77s |
| #259 | Trinity Large Preview none | Arcee AI | 3.7 | 4.8 | $0.008 | 0/3 | 14.3s |
| #215 | KAT-Coder-Air V2.5 medium | Kwaipilot | 3.6 | 5.6 | $0.048 | 0/3 | 23.4s |
| #231 | Seed-2.0-Code none | Bytedance Seed | 3.6 | 5.3 | $0.151 | 0/3 | 13.4s |