- Rang
- #60
- Gesamte Ausgabe-Token
- 299,460
- Antwortzeit (Durchschnitt)
- 68.59s
- Gesamtkosten
- $2.042
Grok 4.5 (medium) vs Grok 4.6 (medium)
Der Durchschnittsscore ist mit 8.5 vs 8.4 praktisch gleichauf. Grok 4.6 (medium) hat die niedrigeren Benchmark-Kosten mit $1.713 vs $2.042. Grok 4.5 (medium) ist schneller mit 68.59s vs 73.46s, mit Erfolgsraten von 83.3% vs 81.8%.
Verglichene Modelle
- Rang
- #62
- Gesamte Ausgabe-Token
- 249,808
- Antwortzeit (Durchschnitt)
- 73.46s
- Gesamtkosten
- $1.713
Empfohlenes Modell
Grok 4.6 (medium)
Es hat die stärkste Punktzahl in diesem Vergleich (8.4) und die beste Gesamtbalance aus Kosten und Antwortzeit über alle 2 Modelle.
Detaillierter Vergleich
| Metrik | Grok 4.5 Grok 4.5 medium | Grok 4.6 Grok 4.6 medium |
|---|---|---|
| Punktzahl | 8.5 | 8.4 |
| Rang | #60 | #62 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.9 | 8.6 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 83.3% | 81.8% |
| Instabile Tests | 3 | 4 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 12.007 | 10.703 |
| Gesamtkosten | $2.042 | $1.713 |
| Eingabepreis | $2.000 / 1M | $2.000 / 1M |
| Ausgabepreis | $6.000 / 1M | $6.000 / 1M |
| Gesamte Eingabe-Token | 122,155 | 106,787 |
| Ausgabe-Token | 5,514 | 4,811 |
| Denk-Token | 293,946 | 244,997 |
| Antwortzeit (Durchschnitt) | 68.59s | 73.46s |
| Antwortzeit (Maximum) | 436.38s | 514.35s |
| Antwortzeit (Gesamt) | 1508.91s | 1616.12s |
| Parameter | ~1.7T insgesamt (~170B aktiv) | ~1.7T insgesamt (~170B aktiv) |
| Verfügbarkeit | Geschlossen | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#60 SpaceXAI: Grok 4.5
medium- Kosten
- $0.044
- Zeit
- 59.4s
- Token
- 7,512 tok
#62 SpaceXAI: Grok 4.6
medium- Kosten
- $0.028
- Zeit
- 72.1s
- Token
- 4,771 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
Schnellvergleich
Vergleichspaar wechseln
DeepSeek V4.1 FlashhighvsGrok 4.5mediumDeepSeek V4.1 FlashlowvsGrok 4.5mediumMuse Spark 1.2lowvsGrok 4.5mediumMuse Spark 1.2lowvsGrok 4.6mediumDeepSeek V4.1 FlashhighvsGrok 4.6mediumDeepSeek V4.1 FlashlowvsGrok 4.6mediumQwen3.8 27BhighvsGrok 4.6mediumGPT-6 SollowvsGrok 4.6mediumInkling SmallhighvsGrok 4.6mediumQwen3.8 27BhighvsGrok 4.5mediumGrok 4.6mediumvsGLM 5.3 FlashXmaxGPT-6 SollowvsGrok 4.5medium