Ranking de Programación
Mira qué modelos de IA rinden mejor en Programación, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Métrica ↑.
Modelos mostrados
7
Promedio de Puntuación de Programación
6.1
Mejor modelo
Gemini 3.1 Flash Lite Preview 0.0
292/292
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Programación | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #50 | GPT-5 Mini medium | OpenAI | 10.0 | 8.1 | $0.241 | 3/3 | 27.6s |
| #51 | Muse Glimmer 30B xhigh | Meta | 10.0 | 8.1 | $0.635 | 3/3 | 105.9s |
| #53 | Muse Spark 1.1 high | Meta | 10.0 | 8.0 | $1.709 | 3/3 | 22.9s |
| #59 | Kimi K3 max | Moonshot AI | 10.0 | 7.9 | $3.467 | 3/3 | 325.8s |
| #69 | Qwen3.8 27B medium | Qwen | 10.0 | 7.8 | ~$0.058 | 3/3 | 40.5s |
| #73 | GLM 5 medium | Z.ai | 10.0 | 7.7 | $0.228 | 3/3 | 74.3s |
| #95 | LongCat 2.0 medium | Meituan | 10.0 | 7.4 | $0.499 | 3/3 | 455.0s |