Ranking de Programación
Mira qué modelos de IA rinden mejor en Programación, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Tiempo de respuesta (promedio) ↑.
Modelos mostrados
15
Promedio de Puntuación de Programación
6.1
Mejor modelo
Gemini 3 PRO Preview 3.0
292/292
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Programación | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #251 | Nemotron 3 Super none | NVIDIA | 3.3 | 4.8 | $0.008 | 0/3 | 2.64s |
| #213 | Mimo V2 PRO none | Xiaomi | 5.5 | 5.6 | $0.045 | 1/3 | 2.65s |
| #143 | Gemini 3.5 Flash minimal | 5.6 | 6.7 | $0.300 | 1/3 | 2.75s | |
| #220 | Mimo V2 Omni none | Xiaomi | 4.4 | 5.5 | $0.021 | 0/3 | 2.75s |
| #207 | Qwen3.5-122B-A10B none | Qwen | 3.7 | 5.7 | $0.247 | 0/3 | 2.77s |
| #167 | Seed-2.0-Lite none | Bytedance Seed | 5.6 | 6.2 | $0.066 | 1/3 | 2.83s |
| #146 | Claude Opus 4.7 none | Anthropic | 3.3 | 6.6 | $0.505 | 1/1 | 2.84s |
| #161 | LongCat 2.0 none | Meituan | 5.5 | 6.4 | $0.044 | 1/3 | 2.85s |
| #269 | Laguna M.1 none | Poolside | 2.5 | 4.4 | $0.009 | 0/1 | 2.93s |
| #158 | Qwen3.6 Max Preview none | Qwen | 3.8 | 6.4 | $0.228 | 0/3 | 3.12s |
| #210 | GLM 5V Turbo none | Z.ai | 5.5 | 5.6 | $0.052 | 1/3 | 3.13s |
| #241 | MiMo-V2.5 none | Xiaomi | 5.5 | 5.1 | $0.025 | 1/3 | 3.24s |
| #106 | Claude Opus 4.8 none | Anthropic | 5.5 | 7.3 | $1.166 | 1/3 | 3.29s |
| #170 | Claude Sonnet 5 none | Anthropic | 4.6 | 6.1 | $0.548 | 0/3 | 3.67s |
| #203 | Inkling Small low | Thinkingmachines | 4.6 | 5.7 | $0.055 | 0/3 | 3.70s |