- Rang
- #70
- Gesamte Ausgabe-Token
- 465,024
- Antwortzeit (Durchschnitt)
- 97.70s
- Gesamtkosten
- $0.724
Muse Glimmer 30B (xhigh) vs Qwen3.7 Max (medium)
Qwen3.7 Max (medium) führt beim Durchschnittsscore mit 8.5 vs 8.4. Muse Glimmer 30B (xhigh) hat die niedrigeren Benchmark-Kosten mit $0.724 vs $2.046. Qwen3.7 Max (medium) ist schneller mit 48.35s vs 97.70s, mit Erfolgsraten von 71.0% vs 85.5%.
Verglichene Modelle
- Rang
- #67
- Gesamte Ausgabe-Token
- 259,032
- Antwortzeit (Durchschnitt)
- 48.35s
- Gesamtkosten
- $2.046
Empfohlenes Modell
Muse Glimmer 30B (xhigh)
Die Punktzahl bleibt nah an der besten hier (8.4 vs 8.5) und es kostet etwa 2.8x weniger als Qwen3.7 Max (medium).
Detaillierter Vergleich
| Metrik | Muse Glimmer 30B Muse Glimmer 30B xhigh | Qwen3.7 Max Qwen3.7 Max medium |
|---|---|---|
| Punktzahl | 8.4 | 8.5 |
| Rang | #70 | #67 |
| Zuverlässigkeit | 9.9 | 10.0 |
| Konsistenz | 8.6 | 8.7 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 71.0% | 85.5% |
| Instabile Tests | 4 | 4 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 5.170 | 12.033 |
| Gesamtkosten | $0.724 | $2.046 |
| Eingabepreis | $0.350 / 1M | $1.475 / 1M |
| Ausgabepreis | $1.500 / 1M | $4.425 / 1M |
| Gesamte Eingabe-Token | 287,538 | 367,848 |
| Ausgabe-Token | 118,266 | 8,753 |
| Denk-Token | 346,758 | 250,279 |
| Antwortzeit (Durchschnitt) | 97.70s | 48.35s |
| Antwortzeit (Maximum) | 576.79s | 556.06s |
| Antwortzeit (Gesamt) | 2247.18s | 1112.11s |
| Parameter | 30B | ~1T insgesamt (~40B aktiv) |
| Verfügbarkeit | Open Source | Geschlossen |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#70 Muse Glimmer 30B
xhigh- Kosten
- $0.007
- Zeit
- 94.6s
- Token
- 4,318 tok
#67 Qwen3.7 Max
medium- Kosten
- $0.017
- Zeit
- 68.8s
- Token
- 4,526 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 145.06s | 176,608 | 1,893 | 16,287 | |
| Qwen3.7 Max | 6.1 | 3.1 | 66.7% | 1 | 137.00s | 261,819 | 3,005 | 29,925 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 13.01s | 822 | 9,982 | 12,542 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 6.36s | 672 | 222 | 8,742 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 105.91s | 7,428 | 18,697 | 63,334 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 35.31s | 7,893 | 423 | 34,808 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 6.0 | 2.7 | 66.7% | 2 | 272.74s | 82,932 | 21,229 | 77,043 | |
| Qwen3.7 Max | 8.7 | 6.9 | 83.3% | 1 | 287.83s | 78,594 | 3,985 | 96,450 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 19.84s | 7,071 | 6,535 | 10,689 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 8.80s | 7,782 | 270 | 6,254 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 2.9 | 7.2 | 11.1% | 1 | 142.55s | 894 | 43,561 | 77,204 | |
| Qwen3.7 Max | 4.1 | 4.4 | 44.5% | 2 | 52.45s | 780 | 61 | 41,143 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 5.5 | 10.0 | 0.0% | 0 | 7.41s | 528 | 1,928 | 2,060 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 11.70s | 516 | 135 | 4,457 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 8.4 | 6.9 | 83.3% | 1 | 8.90s | 771 | 2,420 | 4,507 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 7.46s | 699 | 102 | 5,452 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 7.8 | 9.3 | 66.7% | 0 | 199.67s | 695 | 10,241 | 60,935 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 8.84s | 696 | 259 | 8,908 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 8.08s | 9,555 | 383 | 1,566 | |
| Qwen3.7 Max | 10.0 | 10.0 | 100.0% | 0 | 6.63s | 8,193 | 267 | 1,220 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 3.0 | 10.0 | 0.0% | 0 | 87.23s | 234 | 1,397 | 20,591 | |
| Qwen3.7 Max | 3.0 | 10.0 | 0.0% | 0 | 33.37s | 204 | 24 | 12,920 |
Schnellvergleich
Vergleichspaar wechseln
Muse Glimmer 30BxhighvsGPT-5 MinimediumMuse Spark 1.3lowvsQwen3.7 MaxmediumMuse Glimmer 30BxhighvsQwen3.8 2.4T A95BlowGemini 3.1 Pro PreviewmediumvsMuse Glimmer 30BxhighQwen3.7 MaxmediumvsGrok 4.6highMuse Glimmer 30BxhighvsInklinghighKostenlos verfügbarDeepSeek V4 Flash 0731highvsMuse Glimmer 30BxhighMuse Glimmer 30BxhighvsGLM 5.2highClaude Sonnet 5mediumvsMuse Glimmer 30BxhighClaude Sonnet 5.5highvsQwen3.7 MaxmediumClaude Sonnet 5.5xhighvsQwen3.7 MaxmediumMuse Spark 1.1lowvsQwen3.7 Maxmedium