नेविगेशन
Advertise here

Muse Spark 1.1 (low) vs Qwen3.8 27B (high)

Qwen3.8 27B (high) average score में आगे है: 8.7 vs 8.6. Qwen3.8 27B (high) की benchmark लागत कम है: ~$0.298 vs $0.885. Muse Spark 1.1 (low) तेज है: 13.21s vs 166.34s, pass rates 72.5% vs 78.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#60
कुल आउटपुट टोकन
122,421
प्रतिक्रिया समय (औसत)
13.21s
कुल लागत
$0.885
रैंक
#55
कुल आउटपुट टोकन
677,080
प्रतिक्रिया समय (औसत)
166.34s
कुल लागत
~$0.298
अनुशंसित मॉडल Muse Spark 1.1 (low)

Its score stays close to the best score here (8.6 vs 8.7), while responding about 12.6x faster than Qwen3.8 27B (high).

विस्तृत तुलना

मेट्रिक Muse Spark 1.1 Muse Spark 1.1 low रिलीज़: 2026-07-16 Qwen3.8 27B Qwen3.8 27B high रिलीज़: 2026-08-14 निःशुल्क उपलब्ध
स्कोर 8.6 8.7
रैंक #60 #55
विश्वसनीयता 10.0 9.7
संगति 8.6 9.2
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 72.5% 78.3%
अस्थिर टेस्ट 4 2
कुल रन 69 69
प्रति परिणाम लागत 6.318 ~1.751
कुल लागत $0.885 ~$0.298
इनपुट कीमत $1.250 / 1M लागू नहीं
आउटपुट कीमत $4.250 / 1M लागू नहीं
कुल इनपुट टोकन 291,368 348,967
आउटपुट टोकन 13,469 1,005
रीजनिंग टोकन 108,952 676,075
प्रतिक्रिया समय (औसत) 13.21s 166.34s
प्रतिक्रिया समय (अधिकतम) 54.15s 640.85s
प्रतिक्रिया समय (कुल) 303.92s 3825.81s
पैरामीटर ~1T कुल (~50B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट उपलब्ध

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#60 Muse Spark 1.1

low
लागत
$0.020
समय
39.2s
टोकन
4,947 tok

#55 Qwen3.8 27B

high
लागत
~$0.008
समय
270.1s
टोकन
18,963 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Spark 1.1 10.0 10.0 100.0% 0 10.34s 8,562 394 14,503
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

त्वरित तुलना

तुलना जोड़ी बदलें

Claude Sonnet 5.5xhighvsMuse Spark 1.1lowGPT-5.2mediumvsQwen3.8 27Bhighनिःशुल्क उपलब्धQwen3.8 27Bhighनिःशुल्क उपलब्धvsMiMo-V2.6-PromediumClaude Sonnet 5.5highvsMuse Spark 1.1lowSeed 2.1 TurbomediumvsQwen3.8 27Bhighनिःशुल्क उपलब्धGPT-6 SollowvsQwen3.8 27Bhighनिःशुल्क उपलब्धDeepSeek V4.1 FlashmaxvsMuse Spark 1.1lowDeepSeek V4.1 FlashmaxvsQwen3.8 27Bhighनिःशुल्क उपलब्धMuse Spark 1.2lowvsQwen3.8 27Bhighनिःशुल्क उपलब्धMuse Spark 1.1lowvsGrok 4.6highSeed 2.1 TurbomediumvsMuse Spark 1.1lowMuse Spark 1.1lowvsMiMo-V2.6-Promedium