- Rang
- #161
- Gesamte Ausgabe-Token
- 107,665
- Antwortzeit (Durchschnitt)
- 22.40s
- Gesamtkosten
- $0.266
Muse Glimmer 30B (low) vs Kimi K2.7 Code (medium)
Kimi K2.7 Code (medium) führt beim Durchschnittsscore mit 7.0 vs 6.9. Muse Glimmer 30B (low) hat die niedrigeren Benchmark-Kosten mit $0.266 vs $0.861. Muse Glimmer 30B (low) ist schneller mit 22.40s vs 81.18s, mit Erfolgsraten von 63.8% vs 60.9%.
Verglichene Modelle
- Rang
- #156
- Gesamte Ausgabe-Token
- 259,318
- Antwortzeit (Durchschnitt)
- 81.18s
- Gesamtkosten
- $0.861
Empfohlenes Modell
Muse Glimmer 30B (low)
Die Punktzahl bleibt nah an der besten hier (6.9 vs 7.0) und es kostet etwa 3.2x weniger als Kimi K2.7 Code (medium).
Detaillierter Vergleich
| Metrik | Muse Glimmer 30B Muse Glimmer 30B low | Kimi K2.7 Code Kimi K2.7 Code medium |
|---|---|---|
| Punktzahl | 6.9 | 7.0 |
| Rang | #161 | #156 |
| Zuverlässigkeit | 10.0 | 10.0 |
| Konsistenz | 8.0 | 8.1 |
| Versuche | 69/69 | 69/69 |
| Korrekte Tests | ||
| Erfolgsquote pro Versuch | 63.8% | 60.9% |
| Instabile Tests | 6 | 5 |
| Gesamtläufe | 69 | 69 |
| Kosten pro Ergebnis | 2.414 | 8.755 |
| Gesamtkosten | $0.266 | $0.861 |
| Eingabepreis | $0.350 / 1M | $0.672 / 1M |
| Ausgabepreis | $1.500 / 1M | $3.350 / 1M |
| Gesamte Eingabe-Token | 307,228 | 245,179 |
| Ausgabe-Token | 36,044 | 62,697 |
| Denk-Token | 71,621 | 196,621 |
| Antwortzeit (Durchschnitt) | 22.40s | 81.18s |
| Antwortzeit (Maximum) | 234.92s | 365.80s |
| Antwortzeit (Gesamt) | 515.14s | 1785.87s |
| Parameter | 30B | 1T insgesamt (32B aktiv) |
| Verfügbarkeit | Open Source | Gewichte verfügbar |
Modell-Generierungs-Showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#161 Muse Glimmer 30B
low- Kosten
- $0.002
- Zeit
- 13.5s
- Token
- 953 tok
#156 MoonshotAI: Kimi K2.7 Code
medium- Kosten
- $0.025
- Zeit
- 138.0s
- Token
- 6,093 tok
Top-Modelle nach Score
Score vs. Gesamtkosten
Antwortzeit (Durchschnitt)
Punktzahl vs Antwortzeit (Durchschnitt)
Gesamte Ausgabe-Token
Punktzahl vs Gesamte Ausgabe-Token
Kategorieaufschlüsselung
| Agentenaufgaben | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 6.1 | 3.1 | 66.7% | 1 | 104.96s | 176,916 | 2,177 | 9,518 | |
| Kimi K2.7 Code | 5.0 | 10.0 | 0.0% | 0 | 104.02s | 173,094 | 5,244 | 14,528 |
| Anti-KI-Tricks | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 8.7 | 8.0 | 91.7% | 1 | 3.57s | 810 | 1,054 | 2,240 | |
| Kimi K2.7 Code | 7.3 | 5.8 | 83.3% | 2 | 11.56s | 618 | 3,048 | 5,041 |
| Programmierung | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 8.1 | 9.9 | 66.7% | 0 | 16.52s | 7,419 | 2,759 | 10,173 | |
| Kimi K2.7 Code | 7.8 | 9.3 | 66.7% | 0 | 146.73s | 4,650 | 1,864 | 25,635 |
| Kombiniert | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 3.8 | 5.8 | 33.3% | 1 | 131.97s | 102,271 | 24,417 | 33,400 | |
| Kimi K2.7 Code | 7.3 | 5.8 | 83.3% | 1 | 66.03s | 57,353 | 3,642 | 21,308 |
| Datenanalyse und -extraktion | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 4.17s | 7,065 | 1,219 | 1,841 | |
| Kimi K2.7 Code | 10.0 | 10.0 | 100.0% | 0 | 12.27s | 7,014 | 248 | 2,569 |
| Domänenspezifisch | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 3.5 | 4.4 | 33.3% | 2 | 11.48s | 885 | 3,067 | 6,658 | |
| Kimi K2.7 Code | 3.7 | 6.5 | 22.2% | 1 | 184.17s | 443 | 29,311 | 66,939 |
| Allgemeine Intelligenz | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 5.0 | 10.0 | 0.0% | 0 | 2.50s | 525 | 33 | 542 | |
| Kimi K2.7 Code | 10.0 | 10.0 | 100.0% | 0 | 10.78s | 477 | 1,024 | 1,071 |
| Befolgung von Anweisungen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 8.4 | 6.9 | 83.3% | 1 | 3.60s | 765 | 139 | 1,467 | |
| Kimi K2.7 Code | 9.9 | 10.0 | 100.0% | 0 | 5.39s | 669 | 725 | 1,232 |
| Rätsellösen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 7.7 | 10.0 | 66.7% | 0 | 5.06s | 795 | 545 | 2,721 | |
| Kimi K2.7 Code | 5.9 | 7.7 | 44.4% | 1 | 41.00s | 651 | 15,438 | 17,368 |
| Werkzeugaufrufe | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 5.04s | 9,546 | 385 | 803 | |
| Kimi K2.7 Code | 3.0 | 10.0 | 0.0% | 0 | 0ms | 0 | 0 | 0 |
| Allgemeinwissen | Punktzahl | Konsistenz | Erfolgsquote pro Versuch | Instabile Tests | Korrekte Tests | Antwortzeit (Durchschnitt) | Eingabe-Token | Ausgabe-Token | Denk-Token |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 3.0 | 10.0 | 0.0% | 0 | 9.71s | 231 | 249 | 2,258 | |
| Kimi K2.7 Code | 3.0 | 10.0 | 0.0% | 0 | 341.76s | 210 | 2,153 | 40,930 |
Schnellvergleich
Vergleichspaar wechseln
Muse Glimmer 30BlowvsQwen3.5-122B-A10BmediumEmber-1lowvsKimi K2.7 CodemediumKimi K2.7 CodemediumvsGPT-5.2 ChatnoneKimi K2.7 CodemediumvsGrok 4.6lowGemini 3 Flash PreviewlowvsKimi K2.7 CodemediumGemini 3.1 Flash LitemediumvsMuse Glimmer 30BlowGemini 3.1 Flash Lite PreviewmediumvsMuse Glimmer 30BlowEmber-1highvsMuse Glimmer 30BlowKimi K2.7 CodemediumvsMiMo-V2.6-FlashlowMuse Glimmer 30BlowvsGPT-5.2 ChatnoneGemma 4 31BmediumKostenlos verfügbarvsMuse Glimmer 30BlowClaude Opus 4.8nonevsMuse Glimmer 30Blow