नेविगेशन
Advertise here

Muse Glimmer 30B (high) vs Grok 4.5 (low)

Grok 4.5 (low) average score में आगे है: 7.8 vs 7.7. Muse Glimmer 30B (high) की benchmark लागत कम है: $0.625 vs $1.345. Grok 4.5 (low) तेज है: 18.14s vs 69.87s, pass rates 66.7% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#112
कुल आउटपुट टोकन
388,743
प्रतिक्रिया समय (औसत)
69.87s
कुल लागत
$0.625
रैंक
#109
कुल आउटपुट टोकन
121,415
प्रतिक्रिया समय (औसत)
18.14s
कुल लागत
$1.345
अनुशंसित मॉडल Grok 4.5 (low)

It has the best score here (7.8), while responding about 3.9x faster than Muse Glimmer 30B (high).

विस्तृत तुलना

मेट्रिक Muse Glimmer 30B Muse Glimmer 30B high रिलीज़: 2026-08-11 Grok 4.5 Grok 4.5 low रिलीज़: 2026-07-08
स्कोर 7.7 7.8
रैंक #112 #109
विश्वसनीयता 10.0 10.0
संगति 7.3 9.3
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 66.7% 73.9%
अस्थिर टेस्ट 8 2
कुल रन 69 69
प्रति परिणाम लागत 5.675 8.404
कुल लागत $0.625 $1.345
इनपुट कीमत $0.350 / 1M $2.000 / 1M
आउटपुट कीमत $1.500 / 1M $6.000 / 1M
कुल इनपुट टोकन 281,859 308,068
आउटपुट टोकन 102,526 9,218
रीजनिंग टोकन 286,217 112,197
प्रतिक्रिया समय (औसत) 69.87s 18.14s
प्रतिक्रिया समय (अधिकतम) 451.90s 205.28s
प्रतिक्रिया समय (कुल) 1607.12s 417.21s
पैरामीटर 30B ~1.7T कुल (~170B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#112 Muse Glimmer 30B

high
लागत
$0.005
समय
61.7s
टोकन
3,097 tok

#109 SpaceXAI: Grok 4.5

low
लागत
$0.011
समय
12.4s
टोकन
2,018 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Glimmer 30B 8.8 7.8 88.9% 1 95.97s 7,419 16,128 55,433
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

त्वरित तुलना

तुलना जोड़ी बदलें