Programmeren-ranglijst
Zie welke AI-modellen het best presteren op Programmeren, welke betrouwbaar blijven en waar de grootste verschillen zitten. Sorteren op: Totale kosten ↑.
404/404
Modellen filteren
Geen modellen komen overeen met de huidige zoekopdracht en filters.
| Rang | Model | Bedrijf | Programmeren-score | Score | Totale kosten | Correcte tests | Responstijd (gem.) |
|---|---|---|---|---|---|---|---|
| #12 | GPT-6.1 Sol high | OpenAI | 1.0 | 1.0 | $0.755 | 3/3 | 5.18s |
| #155 | LongCat 2.0 medium | Meituan | 1.0 | 0.7 | $0.767 | 3/3 | 455.0s |
| #99 | Gemini 3.8 Flash medium | 0.8 | 0.8 | $0.769 | 2/3 | 11.7s | |
| #146 | LongCat 2.0 high | Meituan | 0.8 | 0.7 | $0.778 | 2/3 | 505.3s |
| #170 | Grok 4.6 low | X AI | 0.6 | 0.7 | $0.781 | 1/3 | 21.7s |
| #133 | Qwen3.6 Flash medium | Qwen | 0.5 | 0.7 | $0.783 | 0/3 | 42.9s |
| #295 | Ember-1 none | Fireworks | 0.5 | 0.5 | $0.786 | 1/3 | 1.94s |
| #269 | Trinity Large Thinking high | Arcee AI | 0.4 | 0.6 | $0.794 | 0/3 | 245.0s |
| #194 | GPT-5.6 Sol none | OpenAI | 0.5 | 0.7 | $0.795 | 1/3 | 1.39s |
| #205 | Qwen3.6 35B A3B medium | Qwen | 0.8 | 0.7 | $0.834 | 2/3 | 50.5s |
| #217 | Kimi K2.5 medium | Moonshot AI | 0.6 | 0.6 | $0.841 | 1/3 | 217.5s |
| #245 | Trinity Large Thinking medium | Arcee AI | 0.8 | 0.6 | $0.862 | 2/3 | 179.0s |
| #15 | Gemini 3 Flash Preview medium | 0.9 | 1.0 | $0.876 | 2/3 | 84.4s | |
| #91 | Seed-2.0-Code low | Bytedance Seed | 0.7 | 0.8 | $0.881 | 1/3 | 109.7s |
| #54 | Muse Spark 1.2 low | Meta | 0.8 | 0.9 | $0.881 | 2/3 | 10.1s |