Navigate
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Muse Glimmer 30B (medium) vs Qwen3.8 Flash Next (medium)

Muse Glimmer 30B (medium) leads on average score with 7.7 vs 7.6. Qwen3.8 Flash Next (medium) has the lower benchmark cost at ~$0.047 vs $0.353. Qwen3.8 Flash Next (medium) is faster at 24.79s vs 33.97s, with pass rates of 65.2% vs 75.4%.

Last updated at: 2026-10-05

Compared models

Rank
#118
Total Output Tokens
180,687
Response Time (avg)
33.97s
Total Cost
$0.353
Rank
#119
Total Output Tokens
143,965
Response Time (avg)
24.79s
Total Cost
~$0.047
Recommended model Qwen3.8 Flash Next (medium)

Its score stays close to the best score here (7.6 vs 7.7), while costing about 7.5x less than Muse Glimmer 30B (medium).

Detailed comparison

Metric Muse Glimmer 30B Muse Glimmer 30B medium Release: 2026-08-11 Qwen3.8 Flash Next Qwen3.8 Flash Next medium Release: 2026-10-04
Score 7.7 7.6
Rank #118 #119
Reliability 10.0 10.0
Consistency 8.0 7.9
Attempts 69/69 69/69
Tests Correct
Attempt pass rate 65.2% 75.4%
Flaky tests 6 6
Total Runs 69 69
Cost per result 2.935 ~0.314
Total Cost $0.353 ~$0.047
Input Price $0.350 / 1M N/A
Output Price $1.500 / 1M N/A
Cache Read Price $0.040 / 1M N/A
Cache Write Price N/A N/A
Total Input Tokens 269,497 278,792
Output Tokens 34,935 1,695
Reasoning Tokens 145,752 142,270
Response Time (avg) 33.97s 24.79s
Response Time (max) 181.08s 159.62s
Response Time (total) 781.36s 570.26s
Parameters 30B 180B total (6B active)
Availability Open source Weights available

Cache prices apply to input tokens. Reads reuse cached prompts; writes store them and can cost extra. Output tokens use the output price.

Model generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#118 Muse Glimmer 30B

medium
Cost
$0.003
Time
31.9s
Tokens
1,845 tok

#119 Qwen3.8 Flash Next

medium
Cost
~$0.002
Time
40.7s
Tokens
4,059 tok

Top Models by Score

Score vs Total Cost

Response Time (avg)

Score vs Response Time (avg)

Total Output Tokens

Score vs Total Output Tokens

Category Breakdown

Coding Score Consistency Attempt pass rate Flaky tests Tests Correct Response Time (avg) Input Tokens Output Tokens Reasoning Tokens
Muse Glimmer 30B 8.4 7.8 77.8% 1 33.67s 7,419 4,662 20,605
Qwen3.8 Flash Next 10.0 10.0 100.0% 0 45.53s 7,893 346 37,643

Quick Compare

Switch Comparison Pair

GPT-6 LunalowvsQwen3.8 Flash NextmediumMuse Glimmer 30BmediumvsQwen3.7 FlashlowQwen3.8 Flash NextmediumvsSpace Bunny AlphahighMuse Glimmer 30BmediumvsGPT-6 LunahighMuse Glimmer 30BmediumvsGrok 4.5lowSeed-2.0-CodehighvsQwen3.8 Flash NextmediumMuse Glimmer 30BmediumvsQwen3.7 PlusnoneMuse Glimmer 30BmediumvsGPT-6 LunalowMuse Glimmer 30BmediumvsQwen3.8 27BlowFree AvailableMuse Glimmer 30BmediumvsSpace Bunny AlphahighMuse Glimmer 30BhighvsQwen3.8 Flash NextmediumGPT-6 LunahighvsQwen3.8 Flash Nextmedium