- Rank
- #115
- Total Output Tokens
- 388,743
- Response Time (avg)
- 69.87s
- Total Cost
- $0.625
Muse Glimmer 30B (high) vs Grok 4.5 (medium)
Grok 4.5 (medium) leads on average score with 7.8 vs 7.7. Muse Glimmer 30B (high) has the lower benchmark cost at $0.625 vs $2.996. Grok 4.5 (medium) is faster at 68.44s vs 69.87s, with pass rates of 66.7% vs 79.7%.
Compared models
- Rank
- #107
- Total Output Tokens
- 306,044
- Response Time (avg)
- 68.44s
- Total Cost
- $2.996
Recommended model
Grok 4.5 (medium)
It has the strongest score in this comparison (7.8) and the best overall balance of cost and response time across all 2 models.
Detailed comparison
| Metric | Muse Glimmer 30B Muse Glimmer 30B high | Grok 4.5 Grok 4.5 medium |
|---|---|---|
| Score | 7.7 | 7.8 |
| Rank | #115 | #107 |
| Reliability | 10.0 | 10.0 |
| Consistency | 7.3 | 9.0 |
| Attempts | 69/69 | 69/69 |
| Tests Correct | ||
| Attempt pass rate | 66.7% | 79.7% |
| Flaky tests | 8 | 3 |
| Total Runs | 69 | 69 |
| Cost per result | 5.675 | 14.430 |
| Total Cost | $0.625 | $2.996 |
| Input Price | $0.350 / 1M | $2.000 / 1M |
| Output Price | $1.500 / 1M | $6.000 / 1M |
| Cache Read Price | $0.040 / 1M | $0.300 / 1M |
| Cache Write Price | N/A | N/A |
| Total Input Tokens | 281,859 | 308,369 |
| Output Tokens | 102,526 | 7,013 |
| Reasoning Tokens | 286,217 | 299,031 |
| Response Time (avg) | 69.87s | 68.44s |
| Response Time (max) | 451.90s | 436.38s |
| Response Time (total) | 1607.12s | 1574.14s |
| Parameters | 30B | ~1.7T total (~170B active) |
| Availability | Open source | Closed |
Cache prices apply to input tokens. Reads reuse cached prompts; writes store them and can cost extra. Output tokens use the output price.
Model generation showcase
Hamster playing table tennis
Prompt: Create a detailed SVG illustration of a hamster playing table tennis.
#115 Muse Glimmer 30B
high- Cost
- $0.005
- Time
- 61.7s
- Tokens
- 3,097 tok
#107 SpaceXAI: Grok 4.5
medium- Cost
- $0.044
- Time
- 59.4s
- Tokens
- 7,512 tok
Top Models by Score
Score vs Total Cost
Response Time (avg)
Score vs Response Time (avg)
Total Output Tokens
Score vs Total Output Tokens
Category Breakdown
| Agentic | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 139.73s | 178,365 | 1,937 | 16,000 | |
| Grok 4.5 | 5.0 | 10.0 | 0.0% | 0 | 65.24s | 186,214 | 1,499 | 5,085 |
| Anti-AI Tricks | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 8.7 | 7.9 | 91.7% | 1 | 13.18s | 810 | 9,052 | 11,687 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 23.50s | 2,991 | 147 | 4,018 |
| Coding | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 8.8 | 7.8 | 88.9% | 1 | 95.97s | 7,419 | 16,128 | 55,433 | |
| Grok 4.5 | 7.6 | 7.2 | 77.8% | 1 | 155.69s | 9,579 | 390 | 104,634 |
| Combined | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 6.4 | 5.8 | 66.7% | 1 | 115.38s | 75,453 | 4,435 | 49,342 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 29.01s | 83,730 | 4,154 | 16,180 |
| Data parsing and extraction | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 7.3 | 5.9 | 83.3% | 1 | 14.89s | 7,065 | 4,422 | 7,478 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 6.29s | 8,937 | 225 | 3,657 |
| Domain specific | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 2.9 | 7.2 | 11.1% | 1 | 182.58s | 885 | 60,569 | 72,346 | |
| Grok 4.5 | 5.3 | 7.2 | 44.4% | 1 | 249.34s | 2,221 | 11 | 140,815 |
| General Intelligence | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 5.3 | 10.0 | 0.0% | 0 | 6.36s | 525 | 1,574 | 1,659 | |
| Grok 4.5 | 6.5 | 3.4 | 66.7% | 1 | 12.84s | 1,077 | 71 | 2,384 |
| Instructions following | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 8.4 | 6.9 | 83.3% | 1 | 8.62s | 765 | 2,259 | 4,296 | |
| Grok 4.5 | 9.8 | 10.0 | 100.0% | 0 | 6.06s | 1,857 | 57 | 2,728 |
| Puzzle Solving | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 6.1 | 4.7 | 66.7% | 2 | 64.76s | 795 | 846 | 46,992 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 7.75s | 2,430 | 254 | 3,641 |
| Tool Calling | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 10.0 | 10.0 | 100.0% | 0 | 6.41s | 9,546 | 331 | 1,137 | |
| Grok 4.5 | 10.0 | 10.0 | 100.0% | 0 | 6.57s | 8,544 | 192 | 968 |
| Trivia | Score | Consistency | Attempt pass rate | Flaky tests | Tests Correct | Response Time (avg) | Input Tokens | Output Tokens | Reasoning Tokens |
|---|---|---|---|---|---|---|---|---|---|
| Muse Glimmer 30B | 3.0 | 10.0 | 0.0% | 0 | 94.20s | 231 | 973 | 19,847 | |
| Grok 4.5 | 3.0 | 10.0 | 0.0% | 0 | 74.44s | 789 | 13 | 14,921 |
Quick Compare
Switch Comparison Pair
Grok 4.5mediumvsGLM 5.3highMuse Glimmer 30BhighvsQwen3.5 Plus 2026-04-20mediumLing 3.1 FlashhighvsGrok 4.5mediumMuse Glimmer 30BhighvsQwen3.7 FlashlowQwen3.8 2.4T A95BhighvsGrok 4.5mediumQwen3.7 PlusnonevsGrok 4.5mediumDeepSeek V4 Flash 0731mediumvsMuse Glimmer 30BhighMuse Glimmer 30BhighvsGrok 4.5lowMuse Glimmer 30BhighvsQwen3.7 PlusnoneQwen3.7 MaxnonevsGrok 4.5mediumMuse Glimmer 30BhighvsGrok 4.6mediumClaude Fable 5.1highvsGrok 4.5medium