Programmierung-Ranking
Sieh, welche KI-Modelle bei Programmierung am besten abschneiden, welche zuverlässig bleiben und wo die größten Unterschiede liegen. Sortieren nach: Gesamtkosten ↑.
Angezeigte Modelle
15
Durchschnittlicher Wert für Programmierung-Score
0.6
Bestes Modell
Ling 3.1 Flash 1.0
408/408
Modelle filtern
Keine Modelle entsprechen der aktuellen Suche und den Filtern.
| Rang | Modell | Unternehmen | Programmierung-Score | Punktzahl | Gesamtkosten | Korrekte Tests | Antwortzeit (Durchschnitt) |
|---|---|---|---|---|---|---|---|
| #87 | Grok 4.5 high | X AI | 1.0 | 0.8 | $2.687 | 3/3 | 155.2s |
| #20 | GPT-6 Astra medium | OpenAI | 1.0 | 0.9 | $2.707 | 3/3 | 4.95s |
| #81 | Gemini 3.5 Flash high | 1.0 | 0.8 | $2.737 | 3/3 | 23.0s | |
| #159 | Claude Opus 5 none | Anthropic | 0.6 | 0.7 | $2.766 | 1/3 | 5.54s |
| #27 | Claude Opus 5 medium | Anthropic | 1.0 | 0.9 | $2.870 | 3/3 | 9.56s |
| #144 | Grok 4.7 medium | X AI | 0.7 | 0.7 | $2.938 | 1/3 | 312.2s |
| #108 | Qwen3.8 2.4T A95B high | Qwen | 0.6 | 0.8 | $2.949 | 1/3 | 160.5s |
| #233 | Claude Opus 4.6 medium | Anthropic | 0.6 | 0.6 | $2.961 | 1/3 | 30.1s |
| #111 | Grok 4.5 medium | X AI | 0.8 | 0.8 | $2.996 | 2/3 | 155.7s |
| #191 | Grok 4.7 high | X AI | 0.6 | 0.7 | $3.037 | 1/3 | 335.9s |
| #143 | Claude Fable 5.1 medium | Anthropic | 0.7 | 0.7 | $3.197 | 1/3 | 11.0s |
| #193 | Ember-1 max | Fireworks | 0.5 | 0.7 | $3.264 | 1/3 | 105.1s |
| #33 | Qwen3.8 Max (0902) high | Qwen | 1.0 | 0.9 | $3.306 | 3/3 | 253.2s |
| #244 | Claude Fable 5.1 low | Anthropic | 0.3 | 0.6 | $3.395 | 0/3 | 6.75s |
| #187 | Grok 4.7 xhigh | X AI | 0.5 | 0.7 | $3.398 | 1/3 | 414.5s |