नेविगेशन
Advertise here

Muse Glimmer 30B (medium) vs Grok 4.5 (low)

Grok 4.5 (low) average score में आगे है: 7.8 vs 7.7. Muse Glimmer 30B (medium) की benchmark लागत कम है: $0.353 vs $1.345. Grok 4.5 (low) तेज है: 18.14s vs 33.97s, pass rates 65.2% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#115
कुल आउटपुट टोकन
180,687
प्रतिक्रिया समय (औसत)
33.97s
कुल लागत
$0.353
रैंक
#109
कुल आउटपुट टोकन
121,415
प्रतिक्रिया समय (औसत)
18.14s
कुल लागत
$1.345
अनुशंसित मॉडल Muse Glimmer 30B (medium)

Its score stays close to the best score here (7.7 vs 7.8), while costing about 3.8x less than Grok 4.5 (low).

विस्तृत तुलना

मेट्रिक Muse Glimmer 30B Muse Glimmer 30B medium रिलीज़: 2026-08-11 Grok 4.5 Grok 4.5 low रिलीज़: 2026-07-08
स्कोर 7.7 7.8
रैंक #115 #109
विश्वसनीयता 10.0 10.0
संगति 8.0 9.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 65.2% 73.9%
अस्थिर टेस्ट 6 2
कुल रन 69 69
प्रति परिणाम लागत 2.935 8.404
कुल लागत $0.353 $1.345
इनपुट कीमत $0.350 / 1M $2.000 / 1M
आउटपुट कीमत $1.500 / 1M $6.000 / 1M
कुल इनपुट टोकन 269,497 308,068
आउटपुट टोकन 34,935 9,218
रीजनिंग टोकन 145,752 112,197
प्रतिक्रिया समय (औसत) 33.97s 18.14s
प्रतिक्रिया समय (अधिकतम) 181.08s 205.28s
प्रतिक्रिया समय (कुल) 781.36s 417.21s
पैरामीटर 30B ~1.7T कुल (~170B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#115 Muse Glimmer 30B

medium
लागत
$0.003
समय
31.9s
टोकन
1,845 tok

#109 SpaceXAI: Grok 4.5

low
लागत
$0.011
समय
12.4s
टोकन
2,018 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Glimmer 30B 8.4 7.8 77.8% 1 33.67s 7,419 4,662 20,605
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

त्वरित तुलना

तुलना जोड़ी बदलें