- Rang
- #73
- Gesamte Ausgabe-Token
- 433,733
- Antwortzeit (Durchschnitt)
- 106.09s
- Gesamtkosten
- $2.254
Grok 4.7 (medium) vs GLM 5.2 (high)
Grok 4.7 (medium) führt beim Durchschnittsscore mit 8.1 vs 8.0. GLM 5.2 (high) hat die niedrigeren Benchmark-Kosten mit $0.799 vs $2.254. GLM 5.2 (high) ist schneller mit 69.86s vs 106.09s, mit Erfolgsraten von 81.8% vs 69.7%.
Verglichene Modelle
- Rang
- #78
- Gesamte Ausgabe-Token
- 364,655
- Antwortzeit (Durchschnitt)
- 69.86s
- Gesamtkosten
- $0.799
Empfohlenes Modell
GLM 5.2 (high)
Die Punktzahl bleibt nah an der besten hier (8.0 vs 8.1) und es kostet etwa 2.8x weniger als Grok 4.7 (medium).
Detaillierter Vergleich
| Metrik | Grok 4.7 Grok 4.7 medium | GLM 5.2 GLM 5.2 high |
|---|---|---|
| Punktzahl | 8.1 | 8.0 |
| Rang | #73 | #78 |
| Zuverlässigkeit | 9.9 | 10.0 |
| Konsistenz | 8.3 | 8.6 |
| Versuche | 66/66 | 66/66 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 81.8% | 69.7% |
| Instabile Tests | 5 | 3 |
| Gesamtläufe | 66 | 66 |
| Kosten pro Ergebnis | 15.023 | 6.849 |
| Gesamtkosten | $2.254 | $0.799 |
| Eingabepreis | $1.600 / 1M | $0.650 / 1M |
| Ausgabepreis | $4.800 / 1M | $2.042 / 1M |
| Gesamte Eingabe-Token | 107,193 | 83,822 |
| Ausgabe-Token | 4,661 | 72,040 |
| Denk-Token | 429,072 | 292,615 |
| Antwortzeit (Durchschnitt) | 106.09s | 69.86s |
| Antwortzeit (Maximum) | 660.89s | 599.43s |
| Antwortzeit (Gesamt) | 2333.94s | 1536.98s |
| Parameter | ~1.7T insgesamt (~170B aktiv) | 744B insgesamt (40B aktiv) |
| Verfügbarkeit | Geschlossen | Open Source |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#73 SpaceXAI: Grok 4.7
medium- Kosten
- $0.047
- Zeit
- 132.3s
- Token
- 9,954 tok
#78 GLM 5.2
high
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Kosten
- $0.000
- Zeit
- 300.0s
- Token
- 0 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
Schnellvergleich
Vergleichspaar wechseln
InklinghighvsGrok 4.7mediumMuse Spark 1.1highvsGrok 4.7mediumDeepSeek V4 Flash 0731lowvsGLM 5.2highDeepSeek V4 Flash 0731lowvsGrok 4.7mediumMuse Glimmer 30BxhighvsGrok 4.7mediumDeepSeek V4 Flash 0731highvsGrok 4.7mediumInklingmediumvsGLM 5.2highQwen3.8 2.4T A95BlowvsGrok 4.7mediumGrok 4.7lowvsGLM 5.2highKimi K3maxvsGLM 5.2highGPT-5.2 ChatnonevsGLM 5.2highStep 3.7 FlashmediumvsGLM 5.2high