Programmeren-ranglijst
Zie welke AI-modellen het best presteren op Programmeren, welke betrouwbaar blijven en waar de grootste verschillen zitten.
404/404
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Programmeren-score | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #138 | Inkling Small high | Thinkingmachines | 1.0 | 0.7 | $0.398 | 3/3 | 93.2s |
| #151 | Qwen3.8 27B medium | Qwen | 1.0 | 0.7 | ~$0.073 | 3/3 | 40.5s |
| #155 | LongCat 2.0 medium | Meituan | 1.0 | 0.7 | $0.767 | 3/3 | 455.0s |
| #156 | GLM 5 medium | Z.ai | 1.0 | 0.7 | $0.479 | 3/3 | 74.3s |
| #168 | Ember-1 low | Fireworks | 1.0 | 0.7 | $1.488 | 3/3 | 37.9s |
| #364 | Qwen3.6 Plus Preview medium | Qwen | 1.0 | 0.4 | $0.000 | 0/1 | 0ms |
| #367 | Hunter Alpha medium | OpenRouter | 1.0 | 0.4 | $0.000 | 0/1 | 0ms |
| #380 | Hunter Alpha default | OpenRouter | 1.0 | 0.3 | $0.000 | 0/1 | 0ms |
| #398 | Step 3.5 Flash none | Stepfun | 1.0 | 0.2 | $0.020 | 0/1 | 0ms |
| #68 | Claude Sonnet 5 medium | Anthropic | 0.9 | 0.9 | $1.438 | 2/3 | 17.3s |
| #135 | Seed-2.0-Code medium | Bytedance Seed | 0.9 | 0.7 | $1.275 | 2/3 | 89.9s |
| #30 | GPT-5.5 medium | OpenAI | 0.9 | 0.9 | $4.809 | 2/3 | 59.8s |
| #51 | GPT-5.4 medium | OpenAI | 0.9 | 0.9 | $2.213 | 2/3 | 44.4s |
| #113 | Step 3.7 Flash medium | Stepfun | 0.9 | 0.8 | $0.571 | 2/3 | 27.4s |
| #119 | Muse Glimmer 30B high | Meta | 0.9 | 0.8 | $0.506 | 2/3 | 96.0s |