- Rang
- #199
- Gesamte Ausgabe-Token
- 232,542
- Antwortzeit (Durchschnitt)
- 44.53s
- Gesamtkosten
- $0.989
Grok 4.3 (medium) vs GLM 5.1
Der Durchschnittsscore ist mit 6.5 vs 6.5 praktisch gleichauf. GLM 5.1 hat die niedrigeren Benchmark-Kosten mit $0.311 vs $0.989. GLM 5.1 ist schneller mit 11.10s vs 44.53s, mit Erfolgsraten von 63.8% vs 47.8%.
Verglichene Modelle
- Rang
- #196
- Gesamte Ausgabe-Token
- 20,076
- Antwortzeit (Durchschnitt)
- 11.10s
- Gesamtkosten
- $0.311
Empfohlenes Modell
GLM 5.1
Es hat hier die beste Punktzahl (6.5) und kostet etwa 3.2x weniger als Grok 4.3 (medium).
Detaillierter Vergleich
| Metrik | Grok 4.3 Grok 4.3 medium | GLM 5.1 GLM 5.1 none |
|---|---|---|
| Punktzahl | 6.5 | 6.5 |
| Rang | #199 | #196 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.3 | 8.2 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 63.8% | 47.8% |
| Instabile Tests | 5 | 5 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 8.235 | 3.478 |
| Gesamtkosten | $0.989 | $0.311 |
| Eingabepreis | $1.250 / 1M | $0.965 / 1M |
| Ausgabepreis | $2.500 / 1M | $3.032 / 1M |
| Gesamte Eingabe-Token | 325,471 | 258,956 |
| Ausgabe-Token | 14,867 | 20,076 |
| Denk-Token | 217,675 | 0 |
| Antwortzeit (Durchschnitt) | 44.53s | 11.10s |
| Antwortzeit (Maximum) | 216.69s | 107.19s |
| Antwortzeit (Gesamt) | 1024.25s | 255.39s |
| Parameter | ~1.5T insgesamt (~150B aktiv) | 744B insgesamt (40B aktiv) |
| Verfügbarkeit | Geschlossen | Open Source |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#199 SpaceXAI: Grok 4.3
medium- Kosten
- $0.009
- Zeit
- 19.0s
- Token
- 3,661 tok
#196 GLM 5.1
none
Reached the allocated time limit (300 seconds) without receiving showcase output.
- Kosten
- $0.000
- Zeit
- 300.0s
- Token
- 0 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
Schnellvergleich
Vergleichspaar wechseln
KAT-Coder-Pro V2.5highvsGrok 4.3mediumGrok 4.3mediumvsGLM 5.2noneKAT-Coder-Pro V2.5highvsGLM 5.1noneLaguna XS 2.1mediumKostenlos verfügbarvsGLM 5.1noneQwen3.5-122B-A10BnonevsGrok 4.3mediumGrok 4.3mediumvsGLM 5.3lowMercury 2.5highvsGLM 5.1noneGemini 3 Flash PreviewnonevsGrok 4.3mediumQwen3.5 Plus 2026-02-15nonevsGrok 4.3mediumMercury 2.5highvsGrok 4.3mediumMercury 2.5 PreviewhighvsGLM 5.1noneMercury 2.5 PreviewhighvsGrok 4.3medium