Navigation
Advertise here

Hy4 preview (low) vs GLM 5.1

GLM 5.1 führt beim Durchschnittsscore mit 5.7 vs 5.6. GLM 5.1 hat die niedrigeren Benchmark-Kosten mit $0.164 vs $1.745. GLM 5.1 ist schneller mit 6.74s vs 214.25s, mit Erfolgsraten von 19.7% vs 45.5%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-09-23

Verglichene Modelle

Rang
#266
Gesamte Ausgabe-Token
682,538
Antwortzeit (Durchschnitt)
214.25s
Gesamtkosten
$1.745
Rang
#253
Gesamte Ausgabe-Token
14,393
Antwortzeit (Durchschnitt)
6.74s
Gesamtkosten
$0.164
Empfohlenes Modell GLM 5.1

Es hat hier die beste Punktzahl (5.7) und kostet etwa 10.7x weniger als Hy4 preview (low).

Detaillierter Vergleich

Metrik Hy4 preview Hy4 preview low Veröffentlichung: 2026-08-29 GLM 5.1 GLM 5.1 none Veröffentlichung: 2026-04-07
Punktzahl 5.6 5.7
Rang #266 #253
Zuverlässigkeit 5.4 10.0
Konsistenz 8.5 8.2
Versuche 66/66 66/66
Korrekte Tests
Erfolgsquote pro Versuch 19.7% 45.5%
Instabile Tests 3 5
Gesamtläufe 66 66
Kosten pro Ergebnis 58.157 2.073
Gesamtkosten $1.745 $0.164
Eingabepreis $0.834 / 1M $0.966 / 1M
Ausgabepreis $2.501 / 1M $3.036 / 1M
Gesamte Eingabe-Token 45,154 124,219
Ausgabe-Token 4,022 14,393
Denk-Token 678,516 0
Antwortzeit (Durchschnitt) 214.25s 6.74s
Antwortzeit (Maximum) 597.45s 61.20s
Antwortzeit (Gesamt) 4713.56s 148.20s
Parameter 770B insgesamt (49B aktiv) 744B insgesamt (40B aktiv)
Verfügbarkeit Open Source Open Source

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#266 Hy4 preview

low
Provider returned error
Kosten
$0.000
Zeit
1.1s
Token
0 tok

#253 GLM 5.1

none
Reached the allocated time limit (300 seconds) without receiving showcase output.
Kosten
$0.000
Zeit
300.0s
Token
0 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Hy4 preview 5.2 8.6 0.0% 0 219.15s 6,110 135 96,407
GLM 5.1 3.9 9.7 0.0% 0 4.96s 7,256 525 0

Schnellvergleich

Vergleichspaar wechseln