Programmeren-ranglijst
Zie welke AI-modellen het best presteren op Programmeren, welke betrouwbaar blijven en waar de grootste verschillen zitten. Sorteren op: Metriek ↑.
Getoonde modellen
15
Gemiddelde Programmeren-score
6.1
Beste model
Gemini 3.1 Flash Lite Preview 0.0
289/289
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Programmeren-score | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #105 | Kimi K2.6 medium | Moonshot AI | 5.7 | 7.2 | $1.235 | 1/3 | 214.4s |
| #114 | Solar Pro 4 high | Upstage | 5.7 | 7.1 | $0.046 | 1/3 | 244.7s |
| #67 | Claude Sonnet 4.6 medium | Anthropic | 5.7 | 7.8 | $2.126 | 1/3 | 33.3s |
| #74 | Claude Opus 4.6 medium | Anthropic | 5.7 | 7.7 | $2.961 | 1/3 | 30.1s |
| #97 | Gemini 3 Flash Preview low | 5.8 | 7.4 | $0.185 | 1/3 | 6.00s | |
| #79 | Solar Pro 4 xhigh | Upstage | 5.8 | 7.6 | $0.050 | 1/3 | 292.2s |
| #158 | Dots 3 Note Preview high | Dots Studio | 5.8 | 6.4 | $0.000 | 1/3 | 306.2s |
| #146 | Qwen3.5-27B none | Qwen | 5.8 | 6.6 | $0.058 | 1/3 | 1.80s |
| #170 | Qwen3.5-35B-A3B medium | Qwen | 5.9 | 6.1 | $1.140 | 1/3 | 206.6s |
| #157 | Dots 3 Note Preview low | Dots Studio | 5.9 | 6.4 | $0.000 | 1/3 | 287.6s |
| #81 | Claude Opus 5 none | Anthropic | 5.9 | 7.5 | $1.550 | 1/3 | 5.54s |
| #95 | Qwen3.8 2.4T A95B high | Qwen | 5.9 | 7.4 | $2.357 | 1/3 | 160.5s |
| #115 | Grok 4.3 medium | X AI | 5.9 | 7.0 | $0.741 | 1/3 | 41.2s |
| #171 | gpt-oss-120b medium | OpenAI | 5.9 | 6.1 | $0.019 | 1/3 | 38.4s |
| #117 | DeepSeek V3.2 medium | DeepSeek | 6.0 | 7.0 | $0.078 | 1/3 | 248.7s |