नेविगेशन
Advertise here

Muse Glimmer 30B (medium) vs GPT-6 Luna (high)

average score लगभग बराबर है: 7.7 vs 7.7. GPT-6 Luna (high) की benchmark लागत कम है: $0.074 vs $0.353. GPT-6 Luna (high) तेज है: 20.37s vs 33.97s, pass rates 65.2% vs 73.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#115
कुल आउटपुट टोकन
180,687
प्रतिक्रिया समय (औसत)
33.97s
कुल लागत
$0.353
रैंक
#111
कुल आउटपुट टोकन
101,587
प्रतिक्रिया समय (औसत)
20.37s
कुल लागत
$0.074
अनुशंसित मॉडल GPT-6 Luna (high)

It has the best score here (7.7), while costing about 4.8x less than Muse Glimmer 30B (medium).

विस्तृत तुलना

मेट्रिक Muse Glimmer 30B Muse Glimmer 30B medium रिलीज़: 2026-08-11 GPT-6 Luna GPT-6 Luna high रिलीज़: 2026-09-23
स्कोर 7.7 7.7
रैंक #115 #111
विश्वसनीयता 10.0 10.0
संगति 8.0 8.7
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 65.2% 73.9%
अस्थिर टेस्ट 6 4
कुल रन 69 69
प्रति परिणाम लागत 2.935 0.492
कुल लागत $0.353 $0.074
इनपुट कीमत $0.350 / 1M $0.100 / 1M
आउटपुट कीमत $1.500 / 1M $0.500 / 1M
कुल इनपुट टोकन 269,497 229,986
आउटपुट टोकन 34,935 6,037
रीजनिंग टोकन 145,752 95,550
प्रतिक्रिया समय (औसत) 33.97s 20.37s
प्रतिक्रिया समय (अधिकतम) 181.08s 106.93s
प्रतिक्रिया समय (कुल) 781.36s 468.52s
पैरामीटर 30B ~400B कुल (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#115 Muse Glimmer 30B

medium
लागत
$0.003
समय
31.9s
टोकन
1,845 tok

#111 GPT-6 Luna

high
लागत
$0.003
समय
49.2s
टोकन
5,231 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Glimmer 30B 8.4 7.8 77.8% 1 33.67s 7,419 4,662 20,605
GPT-6 Luna 7.8 7.4 77.8% 1 24.69s 7,302 483 15,691

त्वरित तुलना

तुलना जोड़ी बदलें