Ranking de Programación
Mira qué modelos de IA rinden mejor en Programación, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Pruebas correctas ↑.
292/292
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Programación | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #112 | Muse Glimmer 30B medium | Meta | 8.4 | 7.2 | $0.280 | 2/3 | 33.7s |
| #114 | Muse Glimmer 30B low | Meta | 8.1 | 7.1 | $0.187 | 2/3 | 16.5s |
| #115 | Step 3.7 Flash low | Stepfun | 8.2 | 7.1 | $0.390 | 2/3 | 9.46s |
| #122 | Mercury 2 medium | Inception | 8.2 | 7.0 | $0.094 | 2/3 | 2.04s |
| #126 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 7.8 | 6.9 | $0.478 | 2/3 | 33.1s |
| #129 | Gemini 3.5 Flash none | 8.8 | 6.9 | $1.093 | 2/3 | 34.7s | |
| #132 | Seed-2.0-Code medium | Bytedance Seed | 8.9 | 6.8 | $1.153 | 2/3 | 89.9s |
| #145 | LongCat 2.0 high | Meituan | 7.8 | 6.7 | $0.492 | 2/3 | 505.3s |
| #150 | Inkling Small medium | Thinkingmachines | 7.8 | 6.6 | $0.113 | 2/3 | 10.5s |
| #152 | Qwen3.6 35B A3B medium | Qwen | 7.7 | 6.6 | $0.749 | 2/3 | 50.5s |
| #154 | Qwen3.6 27B medium | Qwen | 7.7 | 6.5 | $0.907 | 2/3 | 143.0s |
| #178 | Trinity Large Thinking medium | Arcee AI | 7.5 | 6.1 | $0.798 | 2/3 | 179.0s |
| #1 | Gemini 3.6 Flash high | 10.0 | 9.9 | $0.699 | 3/3 | 26.3s | |
| #2 | Gemini 3.7 Flash high | 10.0 | 9.8 | $0.323 | 3/3 | 13.6s | |
| #3 | Gemini 3.6 Flash medium | 10.0 | 9.8 | $0.427 | 3/3 | 14.8s |