Navigation
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Grok 4.3 (medium) vs GLM 5.2

Der Durchschnittsscore ist mit 6.5 vs 6.5 praktisch gleichauf. GLM 5.2 hat die niedrigeren Benchmark-Kosten mit $0.161 vs $0.989. GLM 5.2 ist schneller mit 11.51s vs 44.53s, mit Erfolgsraten von 63.8% vs 62.3%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-01

Verglichene Modelle

Rang
#199
Gesamte Ausgabe-Token
232,542
Antwortzeit (Durchschnitt)
44.53s
Gesamtkosten
$0.989
Rang
#197
Gesamte Ausgabe-Token
19,230
Antwortzeit (Durchschnitt)
11.51s
Gesamtkosten
$0.161
Empfohlenes Modell GLM 5.2

Es hat hier die beste Punktzahl (6.5) und kostet etwa 6.2x weniger als Grok 4.3 (medium).

Detaillierter Vergleich

Metrik Grok 4.3 Grok 4.3 medium Veröffentlichung: 2026-05-01 GLM 5.2 GLM 5.2 none Veröffentlichung: 2026-06-17
Punktzahl 6.5 6.5
Rang #199 #197
Zuverlässigkeit 10.0 10.0
Konsistenz 8.3 9.0
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 63.8% 62.3%
Instabile Tests 5 3
Gesamtläufe 69 69
Kosten pro Ergebnis 8.235 1.825
Gesamtkosten $0.989 $0.161
Eingabepreis $1.250 / 1M $0.325 / 1M
Ausgabepreis $2.500 / 1M $3.990 / 1M
Gesamte Eingabe-Token 325,471 257,698
Ausgabe-Token 14,867 19,230
Denk-Token 217,675 0
Antwortzeit (Durchschnitt) 44.53s 11.51s
Antwortzeit (Maximum) 216.69s 79.65s
Antwortzeit (Gesamt) 1024.25s 264.72s
Parameter ~1.5T insgesamt (~150B aktiv) 744B insgesamt (40B aktiv)
Verfügbarkeit Geschlossen Open Source

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#199 SpaceXAI: Grok 4.3

medium
Kosten
$0.009
Zeit
19.0s
Token
3,661 tok

#197 GLM 5.2

none
Kosten
$0.033
Zeit
87.7s
Token
7,455 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Grok 4.3 5.9 7.7 44.4% 1 41.23s 8,340 1,028 31,226
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

Schnellvergleich

Vergleichspaar wechseln