नेविगेशन
AI BENCHY
Advertise here

Muse Spark 1.3 (medium) vs GPT-5.5 (medium)

average score लगभग बराबर है: 9.0 vs 9.0. Muse Spark 1.3 (medium) की benchmark लागत कम है: $1.075 vs $4.163. GPT-5.5 (medium) तेज है: 38.97s vs 89.78s, pass rates 81.8% vs 87.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#27
कुल आउटपुट टोकन
223,994
प्रतिक्रिया समय (औसत)
89.78s
कुल लागत
$1.075
रैंक
#22
कुल आउटपुट टोकन
125,316
प्रतिक्रिया समय (औसत)
38.97s
कुल लागत
$4.163
अनुशंसित मॉडल Muse Spark 1.3 (medium)

It has the best score here (9.0), while costing about 3.9x less than GPT-5.5 (medium).

विस्तृत तुलना

मेट्रिक Muse Spark 1.3 Muse Spark 1.3 medium रिलीज़: 2026-09-02 GPT-5.5 GPT-5.5 medium रिलीज़: 2026-04-24
स्कोर 9.0 9.0
रैंक #27 #22
विश्वसनीयता 9.3 10.0
संगति 8.5 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 81.8% 87.9%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 6.716 23.127
कुल लागत $1.075 $4.163
इनपुट कीमत $1.250 / 1M $5.000 / 1M
आउटपुट कीमत $4.250 / 1M $30.000 / 1M
कुल इनपुट टोकन 98,062 80,668
आउटपुट टोकन 13,168 5,617
रीजनिंग टोकन 210,826 119,699
प्रतिक्रिया समय (औसत) 89.78s 38.97s
प्रतिक्रिया समय (अधिकतम) 356.29s 332.10s
प्रतिक्रिया समय (कुल) 1975.17s 857.43s
पैरामीटर ~1T कुल (~50B सक्रिय) ~1.5T कुल (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#27 Muse Spark 1.3

medium
लागत
$0.025
समय
113.4s
टोकन
5,952 tok

#22 GPT-5.5

medium
लागत
$0.112
समय
71.9s
टोकन
3,807 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Spark 1.3 10.0 10.0 100.0% 0 101.89s 7,275 1,374 43,595
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959

त्वरित तुलना

तुलना जोड़ी बदलें