नेविगेशन
AI BENCHY
Advertise here

Muse Glimmer 30B (xhigh) vs GPT-5.2 Chat

Muse Glimmer 30B (xhigh) average score में आगे है: 8.2 vs 8.0. GPT-5.2 Chat की benchmark लागत कम है: $0.604 vs $0.632. GPT-5.2 Chat तेज है: 7.65s vs 94.47s, pass rates 75.8% vs 74.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-11

रैंक
#39
कुल आउटपुट टोकन
455,790
प्रतिक्रिया समय (औसत)
94.47s
कुल लागत
$0.632
रैंक
#45
कुल आउटपुट टोकन
30,424
प्रतिक्रिया समय (औसत)
7.65s
कुल लागत
$0.604
अनुशंसित मॉडल GPT-5.2 Chat

Its score stays close to the best score here (8.0 vs 8.2), while responding about 12.3x faster than Muse Glimmer 30B (xhigh).

विस्तृत तुलना

मेट्रिक Muse Glimmer 30B Muse Glimmer 30B xhigh रिलीज़: 2026-08-11 GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11
स्कोर 8.2 8.0
रैंक #39 #45
विश्वसनीयता 9.8 10.0
संगति 8.3 8.6
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 75.8% 74.2%
अस्थिर टेस्ट 5 4
कुल रन 66 66
प्रति परिणाम लागत 4.509 4.308
कुल लागत $0.632 $0.604
इनपुट कीमत $0.350 / 1M $1.750 / 1M
आउटपुट कीमत $1.500 / 1M $14.000 / 1M
कुल इनपुट टोकन 110,918 101,248
आउटपुट टोकन 126,922 30,424
रीजनिंग टोकन 328,868 0
प्रतिक्रिया समय (औसत) 94.47s 7.65s
प्रतिक्रिया समय (अधिकतम) 576.79s 38.52s
प्रतिक्रिया समय (कुल) 2078.31s 168.39s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#39 Muse Glimmer 30B

xhigh
लागत
$0.007
समय
94.6s
टोकन
4,318 tok

#45 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Glimmer 30B 10.0 10.0 100.0% 0 105.91s 7,428 18,697 63,334
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

त्वरित तुलना

तुलना जोड़ी बदलें