Programmeren-ranglijst
Zie welke AI-modellen het best presteren op Programmeren, welke betrouwbaar blijven en waar de grootste verschillen zitten. Sorteren op: Totale kosten ↑.
404/404
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Programmeren-score | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #46 | Muse Spark 1.2 high | Meta | 1.0 | 0.9 | $2.018 | 3/3 | 22.2s |
| #58 | Seed 2.1 Turbo medium | Bytedance Seed | 0.8 | 0.9 | $2.042 | 2/3 | 354.9s |
| #341 | Gemini 3.1 Flash Lite high | 0.3 | 0.5 | $2.044 | 1/1 | 137.6s | |
| #216 | Claude Sonnet 4.6 medium | Anthropic | 0.6 | 0.6 | $2.126 | 1/3 | 33.3s |
| #24 | Claude Opus 5.5 high | Anthropic | 1.0 | 0.9 | $2.133 | 3/3 | 13.4s |
| #14 | GPT-6 Astra low | OpenAI | 1.0 | 1.0 | $2.160 | 3/3 | 3.97s |
| #51 | GPT-5.4 medium | OpenAI | 0.9 | 0.9 | $2.213 | 2/3 | 44.4s |
| #114 | Grok 4.6 medium | X AI | 0.8 | 0.8 | $2.270 | 2/3 | 120.0s |
| #358 | Gemini 3.1 Flash Lite Preview high | 0.0 | 0.4 | $2.310 | 0/0 | 0ms | |
| #178 | Claude Opus 4.8 none | Anthropic | 0.5 | 0.7 | $2.334 | 1/3 | 3.29s |
| #43 | Claude Opus 5 low | Anthropic | 0.8 | 0.9 | $2.350 | 2/3 | 6.70s |
| #174 | Ember-1 high | Fireworks | 0.8 | 0.7 | $2.405 | 2/3 | 72.2s |
| #76 | Muse Spark 1.1 high | Meta | 1.0 | 0.8 | $2.570 | 3/3 | 22.9s |
| #66 | Grok 4.6 high | X AI | 1.0 | 0.9 | $2.629 | 3/3 | 102.2s |
| #87 | Grok 4.5 high | X AI | 1.0 | 0.8 | $2.687 | 3/3 | 155.2s |