नेविगेशन
AI BENCHY
Advertise here

Muse Glimmer 30B (xhigh) vs GPT-5.2 (medium)

GPT-5.2 (medium) average score में आगे है: 8.4 vs 8.2. Muse Glimmer 30B (xhigh) की benchmark लागत कम है: $0.632 vs $0.951. GPT-5.2 (medium) तेज है: 22.62s vs 94.47s, pass rates 75.8% vs 72.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-12

रैंक
#44
कुल आउटपुट टोकन
455,790
प्रतिक्रिया समय (औसत)
94.47s
कुल लागत
$0.632
रैंक
#36
कुल आउटपुट टोकन
54,782
प्रतिक्रिया समय (औसत)
22.62s
कुल लागत
$0.951
अनुशंसित मॉडल GPT-5.2 (medium)

It has the best score here (8.4), while responding about 4.2x faster than Muse Glimmer 30B (xhigh).

विस्तृत तुलना

मेट्रिक Muse Glimmer 30B Muse Glimmer 30B xhigh रिलीज़: 2026-08-11 GPT-5.2 GPT-5.2 medium रिलीज़: 2025-12-11
स्कोर 8.2 8.4
रैंक #44 #36
विश्वसनीयता 9.8 10.0
संगति 8.3 8.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 75.8% 72.7%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 4.509 6.791
कुल लागत $0.632 $0.951
इनपुट कीमत $0.350 / 1M $1.750 / 1M
आउटपुट कीमत $1.500 / 1M $14.000 / 1M
कुल इनपुट टोकन 110,918 105,004
आउटपुट टोकन 126,922 9,914
रीजनिंग टोकन 328,868 44,868
प्रतिक्रिया समय (औसत) 94.47s 22.62s
प्रतिक्रिया समय (अधिकतम) 576.79s 102.93s
प्रतिक्रिया समय (कुल) 2078.31s 339.28s
पैरामीटर 30B ~1.2T कुल (~80B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#44 Muse Glimmer 30B

xhigh
लागत
$0.007
समय
94.6s
टोकन
4,318 tok

#36 GPT-5.2

medium
लागत
$0.047
समय
49.2s
टोकन
3,396 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Glimmer 30B 10.0 10.0 100.0% 0 105.91s 7,428 18,697 63,334
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912

त्वरित तुलना

तुलना जोड़ी बदलें