Navigate
Advertise here

Muse Glimmer 30B (medium) vs GPT-6 Sol

The average score is effectively tied at 7.2 vs 7.2. Muse Glimmer 30B (medium) has the lower benchmark cost at $0.227 vs $0.280. GPT-6 Sol is faster at 6.84s vs 30.64s, with pass rates of 63.6% vs 66.7%.

Last updated at: 2026-09-23

Compared models

Rank
#151
Total Output Tokens
168,074
Response Time (avg)
30.64s
Total Cost
$0.227
Rank
#148
Total Output Tokens
6,696
Response Time (avg)
6.84s
Total Cost
$0.280
Recommended model GPT-6 Sol

It has the best score here (7.2), while responding about 4.5x faster than Muse Glimmer 30B (medium).

Detailed comparison

Metric Muse Glimmer 30B Muse Glimmer 30B medium Release: 2026-08-11 GPT-6 Sol GPT-6 Sol none Release: 2026-09-23
Score 7.2 7.2
Rank #151 #148
Reliability 10.0 10.0
Consistency 7.9 8.5
Attempts 66/66 66/66
Tests Correct
Attempt pass rate 63.6% 66.7%
Flaky tests 6 4
Total Runs 66 66
Cost per result 2.543 2.151
Total Cost $0.227 $0.280
Input Price $0.300 / 1M $2.000 / 1M
Output Price $1.200 / 1M $10.000 / 1M
Total Input Tokens 116,513 106,332
Output Tokens 33,065 6,696
Reasoning Tokens 135,009 0
Response Time (avg) 30.64s 6.84s
Response Time (max) 181.08s 23.89s
Response Time (total) 674.01s 150.43s
Parameters 30B ~2T total (~150B active)
Availability Open source Closed

Model generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#151 Muse Glimmer 30B

medium
Cost
$0.003
Time
31.9s
Tokens
1,845 tok

#148 GPT-6 Sol

none
Cost
$0.030
Time
31.9s
Tokens
3,055 tok

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Coding Score Consistency Attempt pass rate Flaky tests Tests Correct Response Time (avg) Input Tokens Output Tokens Reasoning Tokens
Muse Glimmer 30B 8.4 7.8 77.8% 1 33.67s 7,419 4,662 20,605
GPT-6 Sol 5.5 10.0 33.3% 0 12.23s 7,302 389 0

Quick Compare

Switch Comparison Pair