- Rang
- #112
- Gesamte Ausgabe-Token
- 121,415
- Antwortzeit (Durchschnitt)
- 18.14s
- Gesamtkosten
- $1.345
Grok 4.5 — low vs medium
medium führt beim Durchschnittsscore mit 7.8 vs 7.8. low hat die niedrigeren Benchmark-Kosten mit $1.345 vs $2.996. low ist schneller mit 18.14s vs 68.44s, mit Erfolgsraten von 73.9% vs 79.7%.
Verglichene Modelle
- Rang
- #107
- Gesamte Ausgabe-Token
- 306,044
- Antwortzeit (Durchschnitt)
- 68.44s
- Gesamtkosten
- $2.996
Empfohlenes Modell
low
Die Punktzahl bleibt nah an der besten hier (7.8 vs 7.8) und es kostet etwa 2.2x weniger als Grok 4.5 (medium).
Detaillierter Vergleich
| Metrik | Grok 4.5 Grok 4.5 low | Grok 4.5 Grok 4.5 medium |
|---|---|---|
| Punktzahl | 7.8 | 7.8 |
| Rang | #112 | #107 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 9.3 | 9.0 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 73.9% | 79.7% |
| Instabile Tests | 2 | 3 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 8.404 | 14.430 |
| Gesamtkosten | $1.345 | $2.996 |
| Eingabepreis | $2.000 / 1M | $2.000 / 1M |
| Ausgabepreis | $6.000 / 1M | $6.000 / 1M |
| Preis für Cache-Lesen | $0.300 / 1M | $0.300 / 1M |
| Preis für Cache-Schreiben | k. A. | k. A. |
| Gesamte Eingabe-Token | 308,068 | 308,369 |
| Ausgabe-Token | 9,218 | 7,013 |
| Denk-Token | 112,197 | 299,031 |
| Antwortzeit (Durchschnitt) | 18.14s | 68.44s |
| Antwortzeit (Maximum) | 205.28s | 436.38s |
| Antwortzeit (Gesamt) | 417.21s | 1574.14s |
| Parameter | ~1.7T insgesamt (~170B aktiv) | ~1.7T insgesamt (~170B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#112 SpaceXAI: Grok 4.5
low- Kosten
- $0.011
- Zeit
- 12.4s
- Token
- 2,018 tok
#107 SpaceXAI: Grok 4.5
medium- Kosten
- $0.044
- Zeit
- 59.4s
- Token
- 7,512 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
Schnellvergleich
Vergleichspaar wechseln
DeepSeek V4 Flash 0731mediumvsGrok 4.5lowGrok 4.5mediumvsGLM 5.3highQwen3.7 PlusnonevsGrok 4.5lowLing 3.1 FlashhighvsGrok 4.5mediumStep 3.7 FlashmediumvsGrok 4.5lowQwen3.8 2.4T A95BhighvsGrok 4.5mediumQwen3.7 PlusnonevsGrok 4.5mediumGrok 4.5lowvsGLM 5.3highGPT-6 LunahighvsGrok 4.5lowMuse Glimmer 30BhighvsGrok 4.5lowLing 3.1 FlashhighvsGrok 4.5lowQwen3.7 MaxnonevsGrok 4.5medium