नेविगेशन
AI BENCHY
Advertise here

Muse Glimmer 30B (xhigh) vs GPT-5 Mini (medium)

Muse Glimmer 30B (xhigh) average score में आगे है: 8.2 vs 8.1. GPT-5 Mini (medium) की benchmark लागत कम है: $0.237 vs $0.632. GPT-5 Mini (medium) तेज है: 27.63s vs 94.47s, pass rates 75.8% vs 63.6%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-11

रैंक
#39
कुल आउटपुट टोकन
455,790
प्रतिक्रिया समय (औसत)
94.47s
कुल लागत
$0.632
रैंक
#41
कुल आउटपुट टोकन
105,932
प्रतिक्रिया समय (औसत)
27.63s
कुल लागत
$0.237
अनुशंसित मॉडल GPT-5 Mini (medium)

Its score stays close to the best score here (8.1 vs 8.2), while costing about 2.7x less than Muse Glimmer 30B (xhigh).

विस्तृत तुलना

मेट्रिक Muse Glimmer 30B Muse Glimmer 30B xhigh रिलीज़: 2026-08-11 GPT-5 Mini GPT-5 Mini medium रिलीज़: 2025-08-07
स्कोर 8.2 8.1
रैंक #39 #41
विश्वसनीयता 9.8 10.0
संगति 8.3 8.8
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 75.8% 63.6%
अस्थिर टेस्ट 5 3
कुल रन 66 66
प्रति परिणाम लागत 4.509 1.971
कुल लागत $0.632 $0.237
इनपुट कीमत $0.350 / 1M $0.250 / 1M
आउटपुट कीमत $1.500 / 1M $2.000 / 1M
कुल इनपुट टोकन 110,918 98,374
आउटपुट टोकन 126,922 14,434
रीजनिंग टोकन 328,868 91,498
प्रतिक्रिया समय (औसत) 94.47s 27.63s
प्रतिक्रिया समय (अधिकतम) 576.79s 111.48s
प्रतिक्रिया समय (कुल) 2078.31s 607.92s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#39 Muse Glimmer 30B

xhigh
लागत
$0.007
समय
94.6s
टोकन
4,318 tok

#41 GPT-5 Mini

medium
लागत
$0.007
समय
42.9s
टोकन
3,432 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Glimmer 30B 10.0 10.0 100.0% 0 105.91s 7,428 18,697 63,334
GPT-5 Mini 10.0 10.0 100.0% 0 27.63s 7,302 658 17,152

त्वरित तुलना

तुलना जोड़ी बदलें