- Rang
- #39
- Gesamte Ausgabe-Token
- 280,567
- Antwortzeit (Durchschnitt)
- 61.71s
- Gesamtkosten
- $1.928
Grok 4.5 (medium) vs Grok 4.6 (medium)
Der Durchschnittsscore ist mit 8.3 vs 8.3 praktisch gleichauf. Grok 4.6 (medium) hat die niedrigeren Benchmark-Kosten mit $1.656 vs $1.928. Grok 4.5 (medium) ist schneller mit 61.71s vs 71.86s, mit Erfolgsraten von 78.8% vs 80.3%.
- Rang
- #40
- Gesamte Ausgabe-Token
- 240,338
- Antwortzeit (Durchschnitt)
- 71.86s
- Gesamtkosten
- $1.656
Empfohlenes Modell
Grok 4.6 (medium)
Es hat die stärkste Punktzahl in diesem Vergleich (8.3) und die beste Gesamtbalance aus Kosten und Antwortzeit über alle 2 Modelle.
Detaillierter Vergleich
| Metrik | Grok 4.5 Grok 4.5 medium | Grok 4.6 Grok 4.6 medium |
|---|---|---|
| Punktzahl | 8.3 | 8.3 |
| Rang | #39 | #40 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.9 | 8.2 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 78.8% | 80.3% |
| Instabile Tests | 3 | 5 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 12.049 | 11.038 |
| Gesamtkosten | $1.928 | $1.656 |
| Eingabepreis | $2.000 / 1M | $2.000 / 1M |
| Ausgabepreis | $6.000 / 1M | $6.000 / 1M |
| Gesamte Eingabe-Token | 122,146 | 106,778 |
| Ausgabe-Token | 5,514 | 4,811 |
| Denk-Token | 275,053 | 235,527 |
| Antwortzeit (Durchschnitt) | 61.71s | 71.86s |
| Antwortzeit (Maximum) | 436.38s | 514.35s |
| Antwortzeit (Gesamt) | 1357.56s | 1580.96s |
| Parameter | ~1.7T insgesamt (~170B aktiv) | ~1.7T insgesamt (~170B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#39 xAI: Grok 4.5
medium- Kosten
- $0.044
- Zeit
- 59.4s
- Token
- 7,512 tok
#40 SpaceXAI: Grok 4.6
medium- Kosten
- $0.028
- Zeit
- 72.1s
- Token
- 4,771 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
Schnellvergleich
Vergleichspaar wechseln
Inkling SmallhighvsGrok 4.5mediumInkling SmallhighvsGrok 4.6mediumMuse Spark 1.1lowvsGrok 4.6mediumMuse Spark 1.1lowvsGrok 4.5mediumMuse Spark 1.2lowvsGrok 4.5mediumMuse Spark 1.2lowvsGrok 4.6mediumMuse Glimmer 30BxhighvsGrok 4.6mediumMuse Glimmer 30BxhighvsGrok 4.5mediumDeepSeek V4 Flash 0731lowvsGrok 4.6mediumQwen3.8 2.4T A95BlowvsGrok 4.6mediumDeepSeek V4 Flash 0731lowvsGrok 4.5mediumQwen3.8 2.4T A95BlowvsGrok 4.5medium