Programmierung-Ranking
Sieh, welche KI-Modelle bei Programmierung am besten abschneiden, welche zuverlässig bleiben und wo die größten Unterschiede liegen. Sortieren nach: Antwortzeit (Durchschnitt) ↓.
Angezeigte Modelle
15
Durchschnittlicher Wert für Programmierung-Score
0.6
Bestes Modell
Mistral Large 4 0.3
408/408
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Programmierung-Score | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #198 | GPT-5.5 none | OpenAI | 0.5 | 0.7 | $1.212 | 1/3 | 1.35s |
| #106 | Qwen3.7 Max none | Qwen | 0.5 | 0.8 | $0.451 | 1/3 | 1.35s |
| #382 | Elephant Alpha medium | Openrouter | 0.4 | 0.4 | $0.000 | 0/3 | 1.30s |
| #396 | Nemotron 3 Nano Omni 30b A3b Reasoning default | NVIDIA | 0.3 | 0.3 | $0.000 | 1/1 | 1.27s |
| #384 | Grok 4.20 none | X AI | 0.1 | 0.3 | $0.057 | 0/1 | 1.22s |
| #373 | Ling 3.0 Tiny default | Inclusionai | 0.4 | 0.4 | $0.000 | 0/3 | 1.19s |
| #293 | Qwen3.8 27B none | Qwen | 0.5 | 0.5 | ~$0.010 | 1/3 | 1.19s |
| #379 | Grok 4.20 Beta default | X AI | 0.2 | 0.4 | $0.087 | 0/1 | 1.14s |
| #317 | Apodex 1.1 Mini default | Apodex | 0.4 | 0.5 | $0.000 | 0/3 | 1.13s |
| #360 | Mercury 2 none | Inception | 0.3 | 0.4 | $0.033 | 0/3 | 1.03s |
| #264 | Nemotron 3 Ultra none | NVIDIA | 0.5 | 0.6 | $0.164 | 1/3 | 1.02s |
| #248 | Inkling none | Thinkingmachines | 0.4 | 0.6 | $0.292 | 0/3 | 1.01s |
| #267 | GPT-5.6 Terra none | OpenAI | 0.5 | 0.6 | $0.377 | 1/3 | 1.00s |
| #300 | GPT-5.6 Luna none | OpenAI | 0.4 | 0.5 | $0.042 | 0/3 | 980ms |
| #314 | Mercury 2.5 low | Inception | 0.5 | 0.5 | $0.020 | 1/3 | 972ms |