Navigate
Advertise here

Muse Glimmer 30B — high vs medium

The average score is effectively tied at 7.2 vs 7.2. medium has the lower benchmark cost at $0.227 vs $0.430. medium is faster at 30.64s vs 66.70s, with pass rates of 65.2% vs 63.6%.

Last updated at: 2026-09-24

Compared models

Rank
#147
Total Output Tokens
370,806
Response Time (avg)
66.70s
Total Cost
$0.430
Rank
#151
Total Output Tokens
168,074
Response Time (avg)
30.64s
Total Cost
$0.227
Recommended model medium

It has the best score here (7.2), while costing about 1.9x less than Muse Glimmer 30B (high).

Detailed comparison

Metric Muse Glimmer 30B Muse Glimmer 30B high Release: 2026-08-11 Muse Glimmer 30B Muse Glimmer 30B medium Release: 2026-08-11
Score 7.2 7.2
Rank #147 #151
Reliability 10.0 10.0
Consistency 7.2 7.9
Attempts 66/66 66/66
Tests Correct
Attempt pass rate 65.2% 63.6%
Flaky tests 8 6
Total Runs 66 66
Cost per result 5.349 2.543
Total Cost $0.430 $0.227
Input Price $0.300 / 1M $0.300 / 1M
Output Price $1.200 / 1M $1.200 / 1M
Total Input Tokens 103,494 116,513
Output Tokens 100,589 33,065
Reasoning Tokens 270,217 135,009
Response Time (avg) 66.70s 30.64s
Response Time (max) 451.90s 181.08s
Response Time (total) 1467.39s 674.01s
Parameters 30B 30B
Availability Open source Open source

Model generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#147 Muse Glimmer 30B

high
Cost
$0.005
Time
61.7s
Tokens
3,097 tok

#151 Muse Glimmer 30B

medium
Cost
$0.003
Time
31.9s
Tokens
1,845 tok

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Coding Score Consistency Attempt pass rate Flaky tests Tests Correct Response Time (avg) Input Tokens Output Tokens Reasoning Tokens
Muse Glimmer 30B 8.8 7.8 88.9% 1 95.97s 7,419 16,128 55,433
Muse Glimmer 30B 8.4 7.8 77.8% 1 33.67s 7,419 4,662 20,605

Quick Compare

Switch Comparison Pair