Programmeren-ranglijst
Zie welke AI-modellen het best presteren op Programmeren, welke betrouwbaar blijven en waar de grootste verschillen zitten. Sorteren op: Correcte tests ↓.
408/408
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Programmeren-score | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #91 | Seed-2.0-Code low | Bytedance Seed | 0.7 | 0.8 | $0.881 | 1/3 | 109.7s |
| #92 | DeepSeek V4 Pro 0423 high | DeepSeek | 0.6 | 0.8 | $0.149 | 1/3 | 243.0s |
| #96 | GPT-5.6 Luna high | OpenAI | 0.5 | 0.8 | $0.118 | 1/3 | 15.6s |
| #98 | GPT-5.4 Nano medium | OpenAI | 0.6 | 0.8 | $0.235 | 1/3 | 19.1s |
| #101 | GPT-5.6 Terra low | OpenAI | 0.7 | 0.8 | $0.435 | 1/3 | 9.56s |
| #102 | Qwen3.5-27B medium | Qwen | 0.6 | 0.8 | $1.135 | 1/3 | 160.7s |
| #106 | Qwen3.7 Max none | Qwen | 0.5 | 0.8 | $0.451 | 1/3 | 1.35s |
| #108 | Qwen3.8 2.4T A95B high | Qwen | 0.6 | 0.8 | $2.949 | 1/3 | 160.5s |
| #109 | MiMo-V2.6-Flash medium | Xiaomi | 0.7 | 0.8 | $0.218 | 1/3 | 18.2s |
| #112 | GLM 5.3 high | Z.ai | 0.7 | 0.8 | $0.495 | 1/3 | 18.9s |
| #115 | Qwen3.7 Plus none | Qwen | 0.5 | 0.8 | $0.178 | 1/3 | 2.15s |
| #117 | DeepSeek V4 Flash 0731 medium | DeepSeek | 0.6 | 0.8 | $0.460 | 1/3 | 198.8s |
| #120 | Claude Haiku 5.5 medium | Anthropic | 0.6 | 0.8 | $0.063 | 1/3 | 7.16s |
| #121 | Qwen3.5 Plus 2026-04-20 medium | Qwen | 0.6 | 0.8 | $0.435 | 1/3 | 125.3s |
| #122 | Qwen3.7 Flash low | Qwen | 0.7 | 0.8 | $0.071 | 1/3 | 42.4s |