Ranking de Programación
Mira qué modelos de IA rinden mejor en Programación, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Tiempo de respuesta (promedio) ↑.
Modelos mostrados
15
Promedio de Puntuación de Programación
6.1
Mejor modelo
Gemini 3 PRO Preview 3.0
292/292
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Programación | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #27 | Claude Opus 5 low | Anthropic | 7.8 | 8.7 | $1.121 | 2/3 | 6.70s |
| #24 | Gemini 3.5 Flash low | 7.8 | 8.8 | $0.449 | 2/3 | 6.71s | |
| #28 | Gemini 3.6 Flash low | 7.8 | 8.7 | $0.251 | 2/3 | 6.95s | |
| #67 | GPT-5.6 Terra medium | OpenAI | 6.1 | 7.8 | $0.523 | 1/3 | 7.19s |
| #140 | GLM 5.2 none | Z.ai | 3.7 | 6.7 | $0.188 | 0/3 | 7.55s |
| #71 | Claude Opus 4.8 low | Anthropic | 6.6 | 7.8 | $2.089 | 1/3 | 7.58s |
| #177 | Inkling low | Thinkingmachines | 5.1 | 6.1 | $0.181 | 0/3 | 8.71s |
| #234 | Qwen3.6 35B A3B none | Qwen | 5.5 | 5.3 | $0.060 | 1/3 | 8.77s |
| #7 | Gemini 3.7 Flash medium | 8.4 | 9.4 | $0.155 | 2/3 | 8.86s | |
| #58 | GPT-5.6 Terra high | OpenAI | 7.6 | 8.0 | $0.836 | 2/3 | 9.14s |
| #8 | GPT-5.6 Sol medium | OpenAI | 10.0 | 9.4 | $0.508 | 3/3 | 9.40s |
| #115 | Step 3.7 Flash low | Stepfun | 8.2 | 7.1 | $0.390 | 2/3 | 9.46s |
| #84 | GPT-5.6 Terra low | OpenAI | 6.6 | 7.5 | $0.420 | 1/3 | 9.56s |
| #15 | Claude Opus 5 medium | Anthropic | 10.0 | 9.2 | $1.586 | 3/3 | 9.56s |
| #288 | gpt-oss-120b none | OpenAI | 1.5 | 3.7 | $0.010 | 0/1 | 9.57s |