- Rang
- #19
- Gesamte Ausgabe-Token
- 125,316
- Antwortzeit (Durchschnitt)
- 38.97s
- Gesamtkosten
- $4.163
GPT-5.5 (medium) vs Grok 4.5 (high)
Der Durchschnittsscore ist mit 9.0 vs 9.0 praktisch gleichauf. Grok 4.5 (high) hat die niedrigeren Benchmark-Kosten mit $2.252 vs $4.163. GPT-5.5 (medium) ist schneller mit 38.97s vs 72.30s, mit Erfolgsraten von 87.9% vs 86.4%.
- Rang
- #21
- Gesamte Ausgabe-Token
- 324,462
- Antwortzeit (Durchschnitt)
- 72.30s
- Gesamtkosten
- $2.252
Empfohlenes Modell
Grok 4.5 (high)
Es hat hier die beste Punktzahl (9.0) und kostet etwa 1.8x weniger als GPT-5.5 (medium).
Detaillierter Vergleich
| Metrik | GPT-5.5 GPT-5.5 medium | Grok 4.5 Grok 4.5 high |
|---|---|---|
| Punktzahl | 9.0 | 9.0 |
| Rang | #19 | #21 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.9 | 8.9 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 87.9% | 86.4% |
| Instabile Tests | 3 | 3 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 23.127 | 12.565 |
| Gesamtkosten | $4.163 | $2.252 |
| Eingabepreis | $5.000 / 1M | $2.000 / 1M |
| Ausgabepreis | $30.000 / 1M | $6.000 / 1M |
| Gesamte Eingabe-Token | 80,668 | 152,175 |
| Ausgabe-Token | 5,617 | 5,655 |
| Denk-Token | 119,699 | 318,807 |
| Antwortzeit (Durchschnitt) | 38.97s | 72.30s |
| Antwortzeit (Maximum) | 332.10s | 676.83s |
| Antwortzeit (Gesamt) | 857.43s | 1590.56s |
| Parameter | ~1.5T insgesamt (~100B aktiv) | ~1.7T insgesamt (~170B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#19 GPT-5.5
medium- Kosten
- $0.112
- Zeit
- 71.9s
- Token
- 3,807 tok
#21 SpaceXAI: Grok 4.5
high- Kosten
- $0.015
- Zeit
- 29.7s
- Token
- 2,737 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
Schnellvergleich
Vergleichspaar wechseln
Qwen3.8 MaxmediumvsGrok 4.5highGPT-5.3-CodexmediumvsGrok 4.5highGemini 3.5 FlashmediumvsGrok 4.5highQwen3.7 MaxmediumvsGrok 4.5highSeed 2.1 TurbolowvsGPT-5.5mediumSeed 2.1 TurbohighvsGPT-5.5mediumSeed 2.1 TurbolowvsGrok 4.5highGemini 3.5 FlashlowvsGrok 4.5highGemini 3.5 FlashlowvsGPT-5.5mediumClaude Opus 5highvsGPT-5.5mediumClaude Opus 4.8mediumvsGrok 4.5highGemini 3.7 FlashlowvsGPT-5.5medium