- Rang
- #115
- Gesamte Ausgabe-Token
- 388,743
- Antwortzeit (Durchschnitt)
- 69.87s
- Gesamtkosten
- $0.625
Muse Glimmer 30B (high) vs Grok 4.5 (medium)
Grok 4.5 (medium) führt beim Durchschnittsscore mit 7.8 vs 7.7. Muse Glimmer 30B (high) hat die niedrigeren Benchmark-Kosten mit $0.625 vs $2.996. Grok 4.5 (medium) ist schneller mit 68.44s vs 69.87s, mit Erfolgsraten von 66.7% vs 79.7%.
Verglichene Modelle
- Rang
- #107
- Gesamte Ausgabe-Token
- 306,044
- Antwortzeit (Durchschnitt)
- 68.44s
- Gesamtkosten
- $2.996
Empfohlenes Modell
Grok 4.5 (medium)
Es hat die stärkste Punktzahl in diesem Vergleich (7.8) und die beste Gesamtbalance aus Kosten und Antwortzeit über alle 2 Modelle.
Detaillierter Vergleich
| Metrik | Muse Glimmer 30B Muse Glimmer 30B high | Grok 4.5 Grok 4.5 medium |
|---|---|---|
| Punktzahl | 7.7 | 7.8 |
| Rang | #115 | #107 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 7.3 | 9.0 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 66.7% | 79.7% |
| Instabile Tests | 8 | 3 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 5.675 | 14.430 |
| Gesamtkosten | $0.625 | $2.996 |
| Eingabepreis | $0.350 / 1M | $2.000 / 1M |
| Ausgabepreis | $1.500 / 1M | $6.000 / 1M |
| Preis für Cache-Lesen | $0.040 / 1M | $0.300 / 1M |
| Preis für Cache-Schreiben | k. A. | k. A. |
| Gesamte Eingabe-Token | 281,859 | 308,369 |
| Ausgabe-Token | 102,526 | 7,013 |
| Denk-Token | 286,217 | 299,031 |
| Antwortzeit (Durchschnitt) | 69.87s | 68.44s |
| Antwortzeit (Maximum) | 451.90s | 436.38s |
| Antwortzeit (Gesamt) | 1607.12s | 1574.14s |
| Parameter | 30B | ~1.7T insgesamt (~170B aktiv) |
| Verfügbarkeit | Open Source | Geschlossen |
Cache-Preise gelten für Eingabetokens. Lesen nutzt gespeicherte Prompts erneut; Schreiben speichert sie und kann mehr kosten. Für Ausgabetokens gilt der Ausgabepreis.
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#115 Muse Glimmer 30B
high- Kosten
- $0.005
- Zeit
- 61.7s
- Token
- 3,097 tok
#107 SpaceXAI: Grok 4.5
medium- Kosten
- $0.044
- Zeit
- 59.4s
- Token
- 7,512 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 139.73s | 178,365 | 1,937 | 16,000 | |
| Grok 4.5 | 5.0 | 10.0 | 0.0% | 0 | 65.24s | 186,214 | 1,499 | 5,085 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 8.7 | 7.9 | 91.7% | 1 | 13.18s | 810 | 9,052 | 11,687 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 23.50s | 2,991 | 147 | 4,018 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 8.8 | 7.8 | 88.9% | 1 | 95.97s | 7,419 | 16,128 | 55,433 | |
| Grok 4.5 | 7.6 | 7.2 | 77.8% | 1 | 155.69s | 9,579 | 390 | 104,634 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 6.4 | 5.8 | 66.7% | 1 | 115.38s | 75,453 | 4,435 | 49,342 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 29.01s | 83,730 | 4,154 | 16,180 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 7.3 | 5.9 | 83.3% | 1 | 14.89s | 7,065 | 4,422 | 7,478 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 6.29s | 8,937 | 225 | 3,657 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 2.9 | 7.2 | 11.1% | 1 | 182.58s | 885 | 60,569 | 72,346 | |
| Grok 4.5 | 5.3 | 7.2 | 44.4% | 1 | 249.34s | 2,221 | 11 | 140,815 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 5.3 | 10.0 | 0.0% | 0 | 6.36s | 525 | 1,574 | 1,659 | |
| Grok 4.5 | 6.5 | 3.4 | 66.7% | 1 | 12.84s | 1,077 | 71 | 2,384 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 8.4 | 6.9 | 83.3% | 1 | 8.62s | 765 | 2,259 | 4,296 | |
| Grok 4.5 | 9.8 | 10.0 | 100.0% | 0 | 6.06s | 1,857 | 57 | 2,728 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 6.1 | 4.7 | 66.7% | 2 | 64.76s | 795 | 846 | 46,992 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 7.75s | 2,430 | 254 | 3,641 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 6.41s | 9,546 | 331 | 1,137 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 6.57s | 8,544 | 192 | 968 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 3.0 | 10.0 | 0.0% | 0 | 94.20s | 231 | 973 | 19,847 | |
| Grok 4.5 | 3.0 | 10.0 | 0.0% | 0 | 74.44s | 789 | 13 | 14,921 |
Schnellvergleich
Vergleichspaar wechseln
Grok 4.5mediumvsGLM 5.3highMuse Glimmer 30BhighvsQwen3.5 Plus 2026-04-20mediumLing 3.1 FlashhighvsGrok 4.5mediumMuse Glimmer 30BhighvsQwen3.7 FlashlowQwen3.8 2.4T A95BhighvsGrok 4.5mediumQwen3.7 PlusnonevsGrok 4.5mediumDeepSeek V4 Flash 0731mediumvsMuse Glimmer 30BhighMuse Glimmer 30BhighvsGrok 4.5lowMuse Glimmer 30BhighvsQwen3.7 PlusnoneQwen3.7 MaxnonevsGrok 4.5mediumMuse Glimmer 30BhighvsGrok 4.6mediumClaude Fable 5.1highvsGrok 4.5medium