Programmeren-ranglijst
Zie welke AI-modellen het best presteren op Programmeren, welke betrouwbaar blijven en waar de grootste verschillen zitten. Sorteren op: Correcte tests ↓.
408/408
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Programmeren-score | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #206 | Qwen3.6 35B A3B medium | Qwen | 0.8 | 0.7 | $0.834 | 2/3 | 50.5s |
| #240 | KAT-Coder-Pro V2.5 medium | Kwaipilot | 0.8 | 0.6 | $0.669 | 2/3 | 33.1s |
| #241 | GLM 5 Turbo medium | Z.ai | 0.8 | 0.6 | $0.323 | 2/3 | 45.9s |
| #245 | Gemini 3.5 Flash none | 0.9 | 0.6 | $1.752 | 2/3 | 34.7s | |
| #246 | Trinity Large Thinking medium | Arcee AI | 0.8 | 0.6 | $0.862 | 2/3 | 179.0s |
| #257 | Inkling Small medium | Thinkingmachines | 0.8 | 0.6 | $0.113 | 2/3 | 10.5s |
| #398 | Decider V1.1 27B default | Perplexity | 0.5 | 0.3 | $0.002 | 1/2 | 305ms |
| #400 | Kev 4B default | Jaredpalmer | 0.5 | 0.2 | $0.002 | 1/2 | 771ms |
| #59 | GPT-6 Sol low | OpenAI | 0.6 | 0.9 | $0.477 | 1/3 | 8.74s |
| #77 | DeepSeek V4 Flash 0731 high | DeepSeek | 0.6 | 0.8 | $0.576 | 1/3 | 252.7s |
| #78 | GLM 5.2 high | Z.ai | 0.6 | 0.8 | $4.632 | 1/3 | 73.0s |
| #80 | Claude Haiku 5.5 high | Anthropic | 0.6 | 0.8 | $0.088 | 1/3 | 9.54s |
| #83 | GPT-6 Luna medium | OpenAI | 0.7 | 0.8 | $0.047 | 1/3 | 23.6s |
| #86 | Qwen3.7 Plus medium | Qwen | 0.6 | 0.8 | $0.415 | 1/3 | 108.6s |
| #89 | GPT-5.6 Terra medium | OpenAI | 0.6 | 0.8 | $0.483 | 1/3 | 7.19s |