नेविगेशन
AI BENCHY
Advertise here

Muse Spark 1.3 (low) vs Qwen3.7 Max (medium)

Qwen3.7 Max (medium) average score में आगे है: 9.1 vs 9.0. Muse Spark 1.3 (low) की benchmark लागत कम है: $0.633 vs $1.157. Muse Spark 1.3 (low) तेज है: 43.67s vs 44.32s, pass rates 83.3% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#25
कुल आउटपुट टोकन
117,915
प्रतिक्रिया समय (औसत)
43.67s
कुल लागत
$0.633
रैंक
#19
कुल आउटपुट टोकन
226,102
प्रतिक्रिया समय (औसत)
44.32s
कुल लागत
$1.157
अनुशंसित मॉडल Muse Spark 1.3 (low)

Its score stays close to the best score here (9.0 vs 9.1), while costing about 1.8x less than Qwen3.7 Max (medium).

विस्तृत तुलना

मेट्रिक Muse Spark 1.3 Muse Spark 1.3 low रिलीज़: 2026-09-02 Qwen3.7 Max Qwen3.7 Max medium रिलीज़: 2026-05-22
स्कोर 9.0 9.1
रैंक #25 #19
विश्वसनीयता 9.6 10.0
संगति 9.0 9.0
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 86.4%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 3.720 8.904
कुल लागत $0.633 $1.157
इनपुट कीमत $1.250 / 1M $1.475 / 1M
आउटपुट कीमत $4.250 / 1M $4.425 / 1M
कुल इनपुट टोकन 104,966 106,029
आउटपुट टोकन 10,208 5,748
रीजनिंग टोकन 107,707 220,354
प्रतिक्रिया समय (औसत) 43.67s 44.32s
प्रतिक्रिया समय (अधिकतम) 190.38s 556.06s
प्रतिक्रिया समय (कुल) 960.70s 975.11s
पैरामीटर ~1T कुल (~50B सक्रिय) ~1T कुल (~40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Muse Spark 1.3

low
लागत
$0.017
समय
83.9s
टोकन
3,959 tok

#19 Qwen3.7 Max

medium
लागत
$0.017
समय
68.8s
टोकन
4,526 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Spark 1.3 10.0 10.0 100.0% 0 53.93s 7,275 1,047 21,679
Qwen3.7 Max 10.0 10.0 100.0% 0 35.31s 7,893 423 34,808

त्वरित तुलना

तुलना जोड़ी बदलें