नेविगेशन
AI BENCHY
Advertise here

Muse Spark 1.3 (high) vs Qwen3.8 Max (medium)

average score लगभग बराबर है: 9.0 vs 9.0. Qwen3.8 Max (medium) की benchmark लागत कम है: $0.771 vs $1.252. Qwen3.8 Max (medium) तेज है: 23.34s vs 117.06s, pass rates 81.8% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#24
कुल आउटपुट टोकन
265,177
प्रतिक्रिया समय (औसत)
117.06s
कुल लागत
$1.252
रैंक
#23
कुल आउटपुट टोकन
92,047
प्रतिक्रिया समय (औसत)
23.34s
कुल लागत
$0.771
अनुशंसित मॉडल Qwen3.8 Max (medium)

It has the best score here (9.0), while costing about 1.6x less than Muse Spark 1.3 (high).

विस्तृत तुलना

मेट्रिक Muse Spark 1.3 Muse Spark 1.3 high रिलीज़: 2026-09-02 Qwen3.8 Max Qwen3.8 Max medium रिलीज़: 2026-08-04
स्कोर 9.0 9.0
रैंक #24 #23
विश्वसनीयता 9.5 10.0
संगति 8.9 9.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 81.8% 80.3%
अस्थिर टेस्ट 3 1
कुल रन 66 66
प्रति परिणाम लागत 7.361 4.532
कुल लागत $1.252 $0.771
इनपुट कीमत $1.250 / 1M $2.000 / 1M
आउटपुट कीमत $4.250 / 1M $6.000 / 1M
कुल इनपुट टोकन 99,477 109,055
आउटपुट टोकन 14,053 6,566
रीजनिंग टोकन 251,124 85,481
प्रतिक्रिया समय (औसत) 117.06s 23.34s
प्रतिक्रिया समय (अधिकतम) 470.12s 126.60s
प्रतिक्रिया समय (कुल) 2575.43s 513.47s
पैरामीटर ~1T कुल (~50B सक्रिय) 2.4T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#24 Muse Spark 1.3

high
लागत
$0.050
समय
203.3s
टोकन
11,679 tok

#23 Qwen3.8 Max

medium
लागत
$0.028
समय
71.9s
टोकन
4,750 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Spark 1.3 10.0 10.0 100.0% 0 146.96s 7,275 2,003 59,912
Qwen3.8 Max 10.0 10.0 100.0% 0 41.35s 7,893 430 23,804

त्वरित तुलना

तुलना जोड़ी बदलें