नेविगेशन
AI BENCHY
Advertise here

Muse Spark 1.3 (low) vs Qwen3.8 Max (medium)

average score लगभग बराबर है: 9.0 vs 9.0. Muse Spark 1.3 (low) की benchmark लागत कम है: $0.633 vs $0.771. Qwen3.8 Max (medium) तेज है: 23.34s vs 43.67s, pass rates 83.3% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#25
कुल आउटपुट टोकन
117,915
प्रतिक्रिया समय (औसत)
43.67s
कुल लागत
$0.633
रैंक
#23
कुल आउटपुट टोकन
92,047
प्रतिक्रिया समय (औसत)
23.34s
कुल लागत
$0.771
अनुशंसित मॉडल Qwen3.8 Max (medium)

It has the best score here (9.0), while responding about 1.9x faster than Muse Spark 1.3 (low).

विस्तृत तुलना

मेट्रिक Muse Spark 1.3 Muse Spark 1.3 low रिलीज़: 2026-09-02 Qwen3.8 Max Qwen3.8 Max medium रिलीज़: 2026-08-04
स्कोर 9.0 9.0
रैंक #25 #23
विश्वसनीयता 9.6 10.0
संगति 9.0 9.7
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 80.3%
अस्थिर टेस्ट 3 1
कुल रन 66 66
प्रति परिणाम लागत 3.720 4.532
कुल लागत $0.633 $0.771
इनपुट कीमत $1.250 / 1M $2.000 / 1M
आउटपुट कीमत $4.250 / 1M $6.000 / 1M
कुल इनपुट टोकन 104,966 109,055
आउटपुट टोकन 10,208 6,566
रीजनिंग टोकन 107,707 85,481
प्रतिक्रिया समय (औसत) 43.67s 23.34s
प्रतिक्रिया समय (अधिकतम) 190.38s 126.60s
प्रतिक्रिया समय (कुल) 960.70s 513.47s
पैरामीटर ~1T कुल (~50B सक्रिय) 2.4T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Muse Spark 1.3

low
लागत
$0.017
समय
83.9s
टोकन
3,959 tok

#23 Qwen3.8 Max

medium
लागत
$0.028
समय
71.9s
टोकन
4,750 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Spark 1.3 10.0 10.0 100.0% 0 53.93s 7,275 1,047 21,679
Qwen3.8 Max 10.0 10.0 100.0% 0 41.35s 7,893 430 23,804

त्वरित तुलना

तुलना जोड़ी बदलें