नेविगेशन
AI BENCHY
Advertise here

Muse Glimmer 30B (xhigh) vs Grok 4.5 (medium)

Grok 4.5 (medium) average score में आगे है: 8.3 vs 8.2. Muse Glimmer 30B (xhigh) की benchmark लागत कम है: $0.632 vs $1.928. Grok 4.5 (medium) तेज है: 61.71s vs 94.47s, pass rates 75.8% vs 78.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-11

रैंक
#39
कुल आउटपुट टोकन
455,790
प्रतिक्रिया समय (औसत)
94.47s
कुल लागत
$0.632
रैंक
#35
कुल आउटपुट टोकन
280,567
प्रतिक्रिया समय (औसत)
61.71s
कुल लागत
$1.928
अनुशंसित मॉडल Muse Glimmer 30B (xhigh)

Its score stays close to the best score here (8.2 vs 8.3), while costing about 3.1x less than Grok 4.5 (medium).

विस्तृत तुलना

मेट्रिक Muse Glimmer 30B Muse Glimmer 30B xhigh रिलीज़: 2026-08-11 Grok 4.5 Grok 4.5 medium रिलीज़: 2026-07-08
स्कोर 8.2 8.3
रैंक #39 #35
विश्वसनीयता 9.8 10.0
संगति 8.3 8.9
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 75.8% 78.8%
अस्थिर टेस्ट 5 3
कुल रन 66 66
प्रति परिणाम लागत 4.509 12.049
कुल लागत $0.632 $1.928
इनपुट कीमत $0.350 / 1M $2.000 / 1M
आउटपुट कीमत $1.500 / 1M $6.000 / 1M
कुल इनपुट टोकन 110,918 122,146
आउटपुट टोकन 126,922 5,514
रीजनिंग टोकन 328,868 275,053
प्रतिक्रिया समय (औसत) 94.47s 61.71s
प्रतिक्रिया समय (अधिकतम) 576.79s 436.38s
प्रतिक्रिया समय (कुल) 2078.31s 1357.56s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#39 Muse Glimmer 30B

xhigh
लागत
$0.007
समय
94.6s
टोकन
4,318 tok

#35 xAI: Grok 4.5

medium
लागत
$0.044
समय
59.4s
टोकन
7,512 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Glimmer 30B 10.0 10.0 100.0% 0 105.91s 7,428 18,697 63,334
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634

त्वरित तुलना

तुलना जोड़ी बदलें