Ranking de Programação
Veja quais modelos de IA vão melhor em Programação, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Métrica ↑.
Modelos exibidos
15
Média de Pontuação de Programação
0.6
Melhor modelo
Gemini 3.1 Flash Lite Preview 0.0
408/408
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Programação | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #231 | Qwen3.5 Plus 2026-02-15 none | Qwen | 0.4 | 0.6 | $0.176 | 0/3 | 2.05s |
| #388 | MiMo-V2-Flash default | Xiaomi | 0.4 | 0.3 | $0.025 | 0/3 | 2.64s |
| #176 | Gemma 4 31B medium | 0.4 | 0.7 | $0.144 | 0/3 | 219.8s | |
| #253 | Apodex 1.1 Mini medium | Apodex | 0.4 | 0.6 | $0.000 | 0/3 | 51.0s |
| #242 | DeepSeek V4 Flash 0731 none | DeepSeek | 0.4 | 0.6 | $0.053 | 0/3 | 1.72s |
| #335 | GLM 4.7 Flash none | Z.ai | 0.4 | 0.5 | $0.027 | 0/3 | 2.54s |
| #309 | KAT Coder AIR V2.5 high | Kwaipilot | 0.4 | 0.5 | $0.077 | 0/3 | 39.1s |
| #304 | Laguna XS 2.1 none | Poolside | 0.4 | 0.5 | $0.020 | 0/3 | 623ms |
| #316 | MiMo-V2.5-Pro none | Xiaomi | 0.4 | 0.5 | $0.135 | 0/3 | 1.41s |
| #354 | Mimo V2 Omni default | Xiaomi | 0.4 | 0.4 | $0.021 | 0/3 | 2.75s |
| #308 | Nemotron 3.5 Lightning high | NVIDIA | 0.4 | 0.5 | $0.168 | 0/3 | 168.4s |
| #312 | Mistral Small 4 medium | Mistral | 0.4 | 0.5 | $0.126 | 0/3 | 40.0s |
| #337 | Nemotron 3.5 Lightning medium | NVIDIA | 0.4 | 0.5 | $0.195 | 0/3 | 285.5s |
| #248 | Inkling none | Thinkingmachines | 0.4 | 0.6 | $0.292 | 0/3 | 1.01s |
| #374 | Granite 4.1 8b default | IBM Granite | 0.4 | 0.4 | $0.007 | 0/3 | 775ms |