नेविगेशन
AI BENCHY
Advertise here

Muse Glimmer 30B (high) vs Grok 4.6 (low)

average score लगभग बराबर है: 7.3 vs 7.4. Grok 4.6 (low) की benchmark लागत कम है: $0.441 vs $0.529. Grok 4.6 (low) तेज है: 14.20s vs 65.50s, pass rates 68.2% vs 71.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#93
कुल आउटपुट टोकन
372,149
प्रतिक्रिया समय (औसत)
65.50s
कुल लागत
$0.529
रैंक
#90
कुल आउटपुट टोकन
36,792
प्रतिक्रिया समय (औसत)
14.20s
कुल लागत
$0.441
अनुशंसित मॉडल Grok 4.6 (low)

It has the best score here (7.4), while responding about 4.6x faster than Muse Glimmer 30B (high).

विस्तृत तुलना

मेट्रिक Muse Glimmer 30B Muse Glimmer 30B high रिलीज़: 2026-08-11 Grok 4.6 Grok 4.6 low रिलीज़: 2026-08-12
स्कोर 7.3 7.4
रैंक #93 #90
विश्वसनीयता 10.0 10.0
संगति 7.6 9.2
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 71.2%
अस्थिर टेस्ट 7 2
कुल रन 66 66
प्रति परिणाम लागत 4.805 2.938
कुल लागत $0.529 $0.441
इनपुट कीमत $0.350 / 1M $2.000 / 1M
आउटपुट कीमत $1.500 / 1M $6.000 / 1M
कुल इनपुट टोकन 103,482 109,951
आउटपुट टोकन 105,680 5,124
रीजनिंग टोकन 266,469 31,668
प्रतिक्रिया समय (औसत) 65.50s 14.20s
प्रतिक्रिया समय (अधिकतम) 451.90s 26.46s
प्रतिक्रिया समय (कुल) 1440.91s 312.33s
पैरामीटर 30B ~1.7T कुल (~170B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#93 Muse Glimmer 30B

high
लागत
$0.005
समय
61.7s
टोकन
3,097 tok

#90 SpaceXAI: Grok 4.6

low
लागत
$0.011
समय
26.0s
टोकन
1,941 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Glimmer 30B 8.8 7.8 88.9% 1 95.97s 7,419 16,128 55,433
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740

त्वरित तुलना

तुलना जोड़ी बदलें