Programmeren-ranglijst
Zie welke AI-modellen het best presteren op Programmeren, welke betrouwbaar blijven en waar de grootste verschillen zitten. Sorteren op: Correcte tests ↓.
289/289
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Programmeren-score | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #1 | Gemini 3.6 Flash high | 10.0 | 9.9 | $0.699 | 3/3 | 26.3s | |
| #2 | Gemini 3.7 Flash high | 10.0 | 9.8 | $0.323 | 3/3 | 13.6s | |
| #3 | Gemini 3.6 Flash medium | 10.0 | 9.8 | $0.427 | 3/3 | 14.8s | |
| #4 | GPT-5.6 Sol low | OpenAI | 10.0 | 9.5 | $0.496 | 3/3 | 11.3s |
| #6 | Gemini 3.5 Flash high | 10.0 | 9.4 | $2.011 | 3/3 | 23.0s | |
| #8 | GPT-5.6 Sol medium | OpenAI | 10.0 | 9.4 | $0.723 | 3/3 | 9.40s |
| #9 | GPT-5.6 Sol high | OpenAI | 10.0 | 9.4 | $0.629 | 3/3 | 12.5s |
| #10 | GPT-5.5 low | OpenAI | 10.0 | 9.3 | $1.257 | 3/3 | 15.0s |
| #11 | Grok 4.6 high | X AI | 10.0 | 9.3 | $1.908 | 3/3 | 102.2s |
| #14 | Claude Opus 5 high | Anthropic | 10.0 | 9.2 | $3.070 | 3/3 | 12.7s |
| #15 | Claude Opus 5 medium | Anthropic | 10.0 | 9.2 | $1.586 | 3/3 | 9.56s |
| #16 | Seed 2.1 Turbo low | Bytedance Seed | 10.0 | 9.1 | $1.546 | 3/3 | 360.8s |
| #17 | Qwen3.7 Max medium | Qwen | 10.0 | 9.1 | $1.157 | 3/3 | 35.3s |
| #20 | Qwen3.8 Max medium | Qwen | 10.0 | 9.0 | $0.771 | 3/3 | 41.3s |
| #21 | Grok 4.5 high | X AI | 10.0 | 9.0 | $2.252 | 3/3 | 155.2s |