Programmeren-ranglijst
Zie welke AI-modellen het best presteren op Programmeren, welke betrouwbaar blijven en waar de grootste verschillen zitten. Sorteren op: Correcte tests ↓.
289/289
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Programmeren-score | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #92 | Kimi K2.7 Code medium | Moonshot AI | 7.8 | 7.4 | $0.709 | 2/3 | 146.7s |
| #100 | KAT-Coder-Pro V2.5 low | Kwaipilot | 7.8 | 7.3 | $0.400 | 2/3 | 24.9s |
| #107 | Muse Glimmer 30B high | Meta | 8.8 | 7.2 | $0.535 | 2/3 | 96.0s |
| #110 | Muse Glimmer 30B medium | Meta | 8.4 | 7.2 | $0.280 | 2/3 | 33.7s |
| #112 | Muse Glimmer 30B low | Meta | 8.1 | 7.1 | $0.187 | 2/3 | 16.5s |
| #113 | Step 3.7 Flash low | Stepfun | 8.2 | 7.1 | $0.390 | 2/3 | 9.46s |
| #120 | Mercury 2 medium | Inception | 8.2 | 7.0 | $0.094 | 2/3 | 2.04s |
| #124 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 7.8 | 6.9 | $0.478 | 2/3 | 33.1s |
| #127 | Gemini 3.5 Flash none | 8.8 | 6.9 | $1.093 | 2/3 | 34.7s | |
| #130 | Seed-2.0-Code medium | Bytedance Seed | 8.9 | 6.8 | $1.153 | 2/3 | 89.9s |
| #143 | LongCat 2.0 high | Meituan | 7.8 | 6.7 | $0.492 | 2/3 | 505.3s |
| #148 | Inkling Small medium | Thinkingmachines | 7.8 | 6.6 | $0.113 | 2/3 | 10.5s |
| #150 | Qwen3.6 35B A3B medium | Qwen | 7.7 | 6.6 | $0.749 | 2/3 | 50.5s |
| #152 | Qwen3.6 27B medium | Qwen | 7.7 | 6.5 | $1.045 | 2/3 | 143.0s |
| #176 | Trinity Large Thinking medium | Arcee AI | 7.5 | 6.1 | $0.798 | 2/3 | 179.0s |