Navigatie
Advertise here

Muse Glimmer 30B (high) vs Grok 4.5 (medium)

Grok 4.5 (medium) leidt in gemiddelde score met 7.8 vs 7.7. Muse Glimmer 30B (high) heeft lagere benchmarkkosten met $0.625 vs $2.996. Grok 4.5 (medium) is sneller met 68.44s vs 69.87s, met slagingspercentages van 66.7% vs 79.7%.

Benchmarks gegenereerd uit AI BENCHY-testsuites op: 2026-10-05

Vergeleken modellen

Rang
#115
Totaal aantal uitvoer-tokens
388,743
Responstijd (gem.)
69.87s
Totale kosten
$0.625
Rang
#107
Totaal aantal uitvoer-tokens
306,044
Responstijd (gem.)
68.44s
Totale kosten
$2.996
Aanbevolen model Grok 4.5 (medium)

Het heeft de sterkste score in deze vergelijking (7.8) en de beste balans tussen kosten en responstijd over alle 2 modellen.

Gedetailleerde vergelijking

Metriek Muse Glimmer 30B Muse Glimmer 30B high Releasedatum: 2026-08-11 Grok 4.5 Grok 4.5 medium Releasedatum: 2026-07-08
Score 7.7 7.8
Rang #115 #107
Betrouwbaarheid 10.0 10.0
Consistentie 7.3 9.0
Pogingen 69/69 69/69
Correcte tests
Slaagpercentage per poging 66.7% 79.7%
Instabiele tests 8 3
Totaal runs 69 69
Kosten per resultaat 5.675 14.430
Totale kosten $0.625 $2.996
Invoerprijs $0.350 / 1M $2.000 / 1M
Uitvoerprijs $1.500 / 1M $6.000 / 1M
Prijs voor cachelezen $0.040 / 1M $0.300 / 1M
Prijs voor cacheschrijven n.v.t. n.v.t.
Totaal aantal invoer-tokens 281,859 308,369
Uitvoer-tokens 102,526 7,013
Redeneer-tokens 286,217 299,031
Responstijd (gem.) 69.87s 68.44s
Responstijd (max) 451.90s 436.38s
Responstijd (totaal) 1607.12s 1574.14s
Parameters 30B ~1.7T totaal (~170B actief)
Beschikbaarheid Open-source Gesloten broncode

Cacheprijzen gelden voor invoertokens. Lezen hergebruikt opgeslagen prompts; schrijven slaat ze op en kan extra kosten. Voor uitvoertokens geldt de uitvoerprijs.

Model generatie-showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#115 Muse Glimmer 30B

high
Kosten
$0.005
Tijd
61.7s
Tokens
3,097 tok

#107 SpaceXAI: Grok 4.5

medium
Kosten
$0.044
Tijd
59.4s
Tokens
7,512 tok

Topmodellen op score

Score vs totale kosten

Responstijd (gem.)

Score vs Responstijd (gem.)

Totaal aantal uitvoer-tokens

Score vs Totaal aantal uitvoer-tokens

Categorie-uitsplitsing

Programmeren Score Consistentie Slaagpercentage per poging Instabiele tests Correcte tests Responstijd (gem.) Invoer-tokens Uitvoer-tokens Redeneer-tokens
Muse Glimmer 30B 8.8 7.8 88.9% 1 95.97s 7,419 16,128 55,433
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

Snelle vergelijking

Vergelijkingspaar wisselen