Ranking de Programación
Mira qué modelos de IA rinden mejor en Programación, cuáles se mantienen fiables y dónde aparecen las mayores diferencias.
292/292
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Programación | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #85 | MiniMax M3 medium | Minimax | 6.1 | 7.5 | $0.300 | 1/3 | 144.7s |
| #64 | Qwen3.6 Plus medium | Qwen | 6.1 | 7.8 | $0.418 | 1/3 | 153.1s |
| #113 | Qwen3.5-122B-A10B medium | Qwen | 6.0 | 7.1 | $1.047 | 1/3 | 114.5s |
| #144 | GLM 5V Turbo medium | Z.ai | 6.0 | 6.7 | $0.457 | 1/3 | 63.4s |
| #165 | Mimo V2 PRO medium | Xiaomi | 6.0 | 6.3 | $0.333 | 1/3 | 94.2s |
| #166 | MiMo-V2-Flash medium | Xiaomi | 6.0 | 6.3 | $0.043 | 1/3 | 10.7s |
| #119 | DeepSeek V3.2 medium | DeepSeek | 6.0 | 7.0 | $0.074 | 1/3 | 248.7s |
| #173 | gpt-oss-120b medium | OpenAI | 5.9 | 6.1 | $0.020 | 1/3 | 38.4s |
| #117 | Grok 4.3 medium | X AI | 5.9 | 7.0 | $0.741 | 1/3 | 41.2s |
| #96 | Qwen3.8 2.4T A95B high | Qwen | 5.9 | 7.4 | $2.357 | 1/3 | 160.5s |
| #82 | Claude Opus 5 none | Anthropic | 5.9 | 7.5 | $1.550 | 1/3 | 5.54s |
| #159 | Dots 3 Note Preview low | Dots Studio | 5.9 | 6.4 | $0.000 | 1/3 | 287.6s |
| #172 | Qwen3.5-35B-A3B medium | Qwen | 5.9 | 6.1 | $1.140 | 1/3 | 206.6s |
| #148 | Qwen3.5-27B none | Qwen | 5.8 | 6.6 | $0.058 | 1/3 | 1.80s |
| #160 | Dots 3 Note Preview high | Dots Studio | 5.8 | 6.4 | $0.000 | 1/3 | 306.2s |