नेविगेशन
Advertise here

Muse Glimmer 30B (medium) vs GPT-6 Luna (low)

Muse Glimmer 30B (medium) average score में आगे है: 7.7 vs 7.6. GPT-6 Luna (low) की benchmark लागत कम है: $0.033 vs $0.353. GPT-6 Luna (low) तेज है: 23.23s vs 33.97s, pass rates 65.2% vs 63.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#115
कुल आउटपुट टोकन
180,687
प्रतिक्रिया समय (औसत)
33.97s
कुल लागत
$0.353
रैंक
#116
कुल आउटपुट टोकन
24,880
प्रतिक्रिया समय (औसत)
23.23s
कुल लागत
$0.033
अनुशंसित मॉडल GPT-6 Luna (low)

Its score stays close to the best score here (7.6 vs 7.7), while costing about 11.0x less than Muse Glimmer 30B (medium).

विस्तृत तुलना

मेट्रिक Muse Glimmer 30B Muse Glimmer 30B medium रिलीज़: 2026-08-11 GPT-6 Luna GPT-6 Luna low रिलीज़: 2026-09-23
स्कोर 7.7 7.6
रैंक #115 #116
विश्वसनीयता 10.0 9.7
संगति 8.0 8.5
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 65.2% 63.8%
अस्थिर टेस्ट 6 4
कुल रन 69 69
प्रति परिणाम लागत 2.935 0.267
कुल लागत $0.353 $0.033
इनपुट कीमत $0.350 / 1M $0.100 / 1M
आउटपुट कीमत $1.500 / 1M $0.500 / 1M
कुल इनपुट टोकन 269,497 195,928
आउटपुट टोकन 34,935 5,728
रीजनिंग टोकन 145,752 19,152
प्रतिक्रिया समय (औसत) 33.97s 23.23s
प्रतिक्रिया समय (अधिकतम) 181.08s 89.37s
प्रतिक्रिया समय (कुल) 781.36s 534.22s
पैरामीटर 30B ~400B कुल (~17B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#115 Muse Glimmer 30B

medium
लागत
$0.003
समय
31.9s
टोकन
1,845 tok

#116 GPT-6 Luna

low
लागत
$0.002
समय
19.2s
टोकन
2,598 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Glimmer 30B 8.4 7.8 77.8% 1 33.67s 7,419 4,662 20,605
GPT-6 Luna 6.0 7.2 55.6% 1 15.39s 7,302 493 6,655

त्वरित तुलना

तुलना जोड़ी बदलें