Navigate
Advertise here

Muse Glimmer 30B — low vs medium

The average score is effectively tied at 7.1 vs 7.2. low has the lower benchmark cost at $0.152 vs $0.227. low is faster at 18.64s vs 30.64s, with pass rates of 63.6% vs 63.6%.

Last updated at: 2026-09-24

Compared models

Rank
#153
Total Output Tokens
95,970
Response Time (avg)
18.64s
Total Cost
$0.152
Rank
#151
Total Output Tokens
168,074
Response Time (avg)
30.64s
Total Cost
$0.227
Recommended model low

It has the best score here (7.1), while responding about 1.6x faster than Muse Glimmer 30B (medium).

Detailed comparison

Metric Muse Glimmer 30B Muse Glimmer 30B low Release: 2026-08-11 Muse Glimmer 30B Muse Glimmer 30B medium Release: 2026-08-11
Score 7.1 7.2
Rank #153 #151
Reliability 10.0 10.0
Consistency 8.2 7.9
Attempts 66/66 66/66
Tests Correct
Attempt pass rate 63.6% 63.6%
Flaky tests 5 6
Total Runs 66 66
Cost per result 1.692 2.543
Total Cost $0.152 $0.227
Input Price $0.300 / 1M $0.300 / 1M
Output Price $1.200 / 1M $1.200 / 1M
Total Input Tokens 130,312 116,513
Output Tokens 33,867 33,065
Reasoning Tokens 62,103 135,009
Response Time (avg) 18.64s 30.64s
Response Time (max) 234.92s 181.08s
Response Time (total) 410.18s 674.01s
Parameters 30B 30B
Availability Open source Open source

Model generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#153 Muse Glimmer 30B

low
Cost
$0.002
Time
13.5s
Tokens
953 tok

#151 Muse Glimmer 30B

medium
Cost
$0.003
Time
31.9s
Tokens
1,845 tok

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Coding Score Consistency Attempt pass rate Flaky tests Tests Correct Response Time (avg) Input Tokens Output Tokens Reasoning Tokens
Muse Glimmer 30B 8.1 9.9 66.7% 0 16.52s 7,419 2,759 10,173
Muse Glimmer 30B 8.4 7.8 77.8% 1 33.67s 7,419 4,662 20,605

Quick Compare

Switch Comparison Pair