Navigation
Advertise here

Muse Glimmer 30B (xhigh) vs Qwen3.7 Max (medium)

Qwen3.7 Max (medium) führt beim Durchschnittsscore mit 8.5 vs 8.4. Muse Glimmer 30B (xhigh) hat die niedrigeren Benchmark-Kosten mit $0.724 vs $2.046. Qwen3.7 Max (medium) ist schneller mit 48.35s vs 97.70s, mit Erfolgsraten von 71.0% vs 85.5%.

Benchmarks aus AI BENCHY-Test-Suites generiert am: 2026-10-01

Verglichene Modelle

Rang
#70
Gesamte Ausgabe-Token
465,024
Antwortzeit (Durchschnitt)
97.70s
Gesamtkosten
$0.724
Rang
#67
Gesamte Ausgabe-Token
259,032
Antwortzeit (Durchschnitt)
48.35s
Gesamtkosten
$2.046
Empfohlenes Modell Muse Glimmer 30B (xhigh)

Die Punktzahl bleibt nah an der besten hier (8.4 vs 8.5) und es kostet etwa 2.8x weniger als Qwen3.7 Max (medium).

Detaillierter Vergleich

Metrik Muse Glimmer 30B Muse Glimmer 30B xhigh Veröffentlichung: 2026-08-11 Qwen3.7 Max Qwen3.7 Max medium Veröffentlichung: 2026-05-22
Punktzahl 8.4 8.5
Rang #70 #67
Zuverlässigkeit 9.9 10.0
Konsistenz 8.6 8.7
Versuche 69/69 69/69
Korrekte Tests
Erfolgsquote pro Versuch 71.0% 85.5%
Instabile Tests 4 4
Gesamtläufe 69 69
Kosten pro Ergebnis 5.170 12.033
Gesamtkosten $0.724 $2.046
Eingabepreis $0.350 / 1M $1.475 / 1M
Ausgabepreis $1.500 / 1M $4.425 / 1M
Gesamte Eingabe-Token 287,538 367,848
Ausgabe-Token 118,266 8,753
Denk-Token 346,758 250,279
Antwortzeit (Durchschnitt) 97.70s 48.35s
Antwortzeit (Maximum) 576.79s 556.06s
Antwortzeit (Gesamt) 2247.18s 1112.11s
Parameter 30B ~1T insgesamt (~40B aktiv)
Verfügbarkeit Open Source Geschlossen

Modell-Generierungs-Showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#70 Muse Glimmer 30B

xhigh
Kosten
$0.007
Zeit
94.6s
Token
4,318 tok

#67 Qwen3.7 Max

medium
Kosten
$0.017
Zeit
68.8s
Token
4,526 tok

Top-Modelle nach Score

Score vs. Gesamtkosten

Antwortzeit (Durchschnitt)

Punktzahl vs Antwortzeit (Durchschnitt)

Gesamte Ausgabe-Token

Punktzahl vs Gesamte Ausgabe-Token

Kategorieaufschlüsselung

Programmierung Punktzahl Konsistenz Erfolgsquote pro Versuch Instabile Tests Korrekte Tests Antwortzeit (Durchschnitt) Eingabe-Token Ausgabe-Token Denk-Token
Muse Glimmer 30B 10.0 10.0 100.0% 0 105.91s 7,428 18,697 63,334
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808

Schnellvergleich

Vergleichspaar wechseln