Programmeren-ranglijst
Zie welke AI-modellen het best presteren op Programmeren, welke betrouwbaar blijven en waar de grootste verschillen zitten. Sorteren op: Correcte tests ↑.
289/289
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Programmeren-score | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #83 | GPT-5.6 Terra low | OpenAI | 6.6 | 7.5 | $0.420 | 1/3 | 9.56s |
| #84 | MiniMax M3 medium | Minimax | 6.1 | 7.5 | $0.300 | 1/3 | 144.7s |
| #85 | GPT 5.3 Chat none | OpenAI | 5.6 | 7.5 | $0.533 | 1/3 | 10.5s |
| #86 | Qwen3.5 Plus 2026-02-15 medium | Qwen | 6.6 | 7.5 | $0.459 | 1/3 | 180.7s |
| #87 | Qwen3.5-27B medium | Qwen | 6.2 | 7.5 | $0.982 | 1/3 | 160.7s |
| #89 | Grok Build 0.1 medium | X AI | 5.7 | 7.5 | $1.130 | 1/3 | 108.5s |
| #90 | Gemini 3.1 Flash Lite Preview medium | 5.5 | 7.4 | $0.117 | 1/3 | 4.09s | |
| #91 | Qwen3.7 Max none | Qwen | 5.5 | 7.4 | $0.197 | 1/3 | 1.35s |
| #93 | GPT-5.6 Luna medium | OpenAI | 5.4 | 7.4 | $0.072 | 1/3 | 10.4s |
| #95 | Qwen3.8 2.4T A95B high | Qwen | 5.9 | 7.4 | $2.357 | 1/3 | 160.5s |
| #96 | Grok 4.6 low | X AI | 5.5 | 7.4 | $0.449 | 1/3 | 21.7s |
| #97 | Gemini 3 Flash Preview low | 5.8 | 7.4 | $0.185 | 1/3 | 6.00s | |
| #98 | Claude Sonnet 4.6 none | Anthropic | 5.5 | 7.3 | $0.661 | 1/3 | 5.19s |
| #99 | GLM 5.3 high | Z.ai | 6.6 | 7.3 | $0.403 | 1/3 | 18.9s |
| #101 | Gemini 3.1 Flash Lite medium | 5.5 | 7.3 | $0.120 | 1/3 | 3.81s |