Navigate
Advertise here

Muse Glimmer 30B (low) vs GPT-5.2 Chat

GPT-5.2 Chat leads on average score with 7.0 vs 6.9. Muse Glimmer 30B (low) has the lower benchmark cost at $0.266 vs $0.594. GPT-5.2 Chat is faster at 7.43s vs 22.40s, with pass rates of 63.8% vs 66.7%.

Last updated at: 2026-10-01

Compared models

Rank
#161
Total Output Tokens
107,665
Response Time (avg)
22.40s
Total Cost
$0.266
Rank
#153
Total Output Tokens
29,742
Response Time (avg)
7.43s
Total Cost
$0.594
Recommended model GPT-5.2 Chat

It has the best score here (7.0), while responding about 3.0x faster than Muse Glimmer 30B (low).

Detailed comparison

Metric Muse Glimmer 30B Muse Glimmer 30B low Release: 2026-08-11 GPT-5.2 Chat GPT-5.2 Chat none Release: 2025-12-11
Score 6.9 7.0
Rank #161 #153
Reliability 10.0 10.0
Consistency 8.0 8.7
Attempts 69/69 69/69
Tests Correct
Attempt pass rate 63.8% 66.7%
Flaky tests 6 4
Total Runs 69 69
Cost per result 2.414 4.564
Total Cost $0.266 $0.594
Input Price $0.350 / 1M $1.750 / 1M
Output Price $1.500 / 1M $14.000 / 1M
Total Input Tokens 307,228 101,104
Output Tokens 36,044 29,742
Reasoning Tokens 71,621 0
Response Time (avg) 22.40s 7.43s
Response Time (max) 234.92s 38.52s
Response Time (total) 515.14s 163.35s
Parameters 30B ~400B total (~17B active)
Availability Open source Closed

Model generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#161 Muse Glimmer 30B

low
Cost
$0.002
Time
13.5s
Tokens
953 tok

#153 GPT-5.2 Chat

none
Cost
$0.010
Time
15.3s
Tokens
797 tok

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Coding Score Consistency Attempt pass rate Flaky tests Tests Correct Response Time (avg) Input Tokens Output Tokens Reasoning Tokens
Muse Glimmer 30B 8.1 9.9 66.7% 0 16.52s 7,419 2,759 10,173
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

Quick Compare

Switch Comparison Pair