Ranking de Programación
Mira qué modelos de IA rinden mejor en Programación, cuáles se mantienen fiables y dónde aparecen las mayores diferencias. Ordenar por: Tiempo de respuesta (promedio) ↑.
Modelos mostrados
15
Promedio de Puntuación de Programación
6.1
Mejor modelo
Gemini 3 PRO Preview 3.0
292/292
Filtrar modelos
Ningún modelo coincide con la búsqueda y los filtros actuales.
| Rango | Modelo | Empresa | Puntuación de Programación | Puntuación | Costo total | Pruebas correctas | Tiempo de respuesta (promedio) |
|---|---|---|---|---|---|---|---|
| #64 | Qwen3.6 Plus medium | Qwen | 6.1 | 7.8 | $0.418 | 1/3 | 153.1s |
| #21 | Grok 4.5 high | X AI | 10.0 | 9.0 | $2.252 | 3/3 | 155.2s |
| #38 | Grok 4.5 medium | X AI | 7.6 | 8.5 | $2.042 | 2/3 | 155.7s |
| #70 | Seed-2.0-Lite medium | Bytedance Seed | 8.0 | 7.8 | $0.236 | 2/3 | 156.7s |
| #222 | Laguna S 2.1 medium | Poolside | 5.3 | 5.4 | $0.053 | 1/3 | 159.0s |
| #96 | Qwen3.8 2.4T A95B high | Qwen | 5.9 | 7.4 | $2.357 | 1/3 | 160.5s |
| #88 | Qwen3.5-27B medium | Qwen | 6.2 | 7.5 | $0.982 | 1/3 | 160.7s |
| #54 | DeepSeek V4 Flash 0731 low | DeepSeek | 7.3 | 8.0 | $0.031 | 1/3 | 163.3s |
| #246 | Laguna S 2.1 low | Poolside | 3.8 | 5.0 | $0.082 | 0/3 | 167.5s |
| #216 | Nemotron 3.5 Lightning high | NVIDIA | 4.4 | 5.6 | $0.134 | 0/3 | 168.4s |
| #283 | Ling 3.0 Tiny low | Inclusionai | 2.9 | 3.8 | $0.000 | 0/3 | 170.7s |
| #49 | Qwen3.8 2.4T A95B low | Qwen | 7.8 | 8.1 | $2.672 | 2/3 | 172.5s |
| #282 | Ling 3.0 Tiny high | Inclusionai | 2.9 | 3.8 | $0.000 | 0/3 | 177.7s |
| #178 | Trinity Large Thinking medium | Arcee AI | 7.5 | 6.1 | $0.798 | 2/3 | 179.0s |
| #87 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 6.6 | 7.5 | $0.459 | 1/3 | 180.7s |