Ranking de Programação
Veja quais modelos de IA vão melhor em Programação, quais permanecem confiáveis e onde aparecem as maiores diferenças. Ordenar por: Custo total ↑.
408/408
Filtrar modelos
Nenhum modelo corresponde à pesquisa e aos filtros atuais.
| Posição | Modelo | Empresa | Pontuação de Programação | Pontuação | Custo total | Testes corretos | Tempo de resposta (médio) |
|---|---|---|---|---|---|---|---|
| #42 | Gemini 3.5 Flash Lite high | 0.8 | 0.9 | $0.624 | 2/3 | 16.6s | |
| #201 | LongCat 2.0 low | Meituan | 0.7 | 0.7 | $0.630 | 1/3 | 479.3s |
| #254 | Claude Sonnet 4.6 none | Anthropic | 0.5 | 0.6 | $0.661 | 1/3 | 5.19s |
| #240 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 0.8 | 0.6 | $0.669 | 2/3 | 33.1s |
| #97 | Nemotron 3 Ultra medium | NVIDIA | 0.8 | 0.8 | $0.674 | 2/3 | 26.5s |
| #145 | Gemini 2.5 Flash medium | 0.8 | 0.7 | $0.680 | 2/3 | 41.0s | |
| #333 | Mimo V2 Omni medium | Xiaomi | 0.3 | 0.5 | $0.683 | 0/3 | 183.9s |
| #279 | GPT-5.4 none | OpenAI | 0.5 | 0.6 | $0.690 | 1/3 | 1.62s |
| #79 | GPT-5.6 Terra high | OpenAI | 0.8 | 0.8 | $0.698 | 2/3 | 9.14s |
| #18 | GPT-6 Sol medium | OpenAI | 0.8 | 0.9 | $0.703 | 2/3 | 11.8s |
| #225 | Qwen3.5-35B-A3B medium | Qwen | 0.6 | 0.6 | $0.716 | 1/3 | 206.6s |
| #229 | Gemini 3.1 Flash Lite low | 0.5 | 0.6 | $0.717 | 1/3 | 1.53s | |
| #228 | Gemini 3.1 Flash Lite Preview low | 0.5 | 0.6 | $0.736 | 1/3 | 1.39s | |
| #252 | KAT-Coder-Pro V2.5 default | Kwaipilot | 0.6 | 0.6 | $0.742 | 1/3 | 22.5s |
| #324 | Grok 4.20 Beta medium | X AI | 0.3 | 0.5 | $0.750 | 1/1 | 31.4s |