नेविगेशन
AI BENCHY
Advertise here

Muse Spark 1.3 (low) vs GPT-5.6 Sol (high)

GPT-5.6 Sol (high) average score में आगे है: 9.4 vs 9.0. GPT-5.6 Sol (high) की benchmark लागत कम है: $0.446 vs $0.633. GPT-5.6 Sol (high) तेज है: 11.48s vs 43.67s, pass rates 83.3% vs 89.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#25
कुल आउटपुट टोकन
117,915
प्रतिक्रिया समय (औसत)
43.67s
कुल लागत
$0.633
रैंक
#10
कुल आउटपुट टोकन
28,708
प्रतिक्रिया समय (औसत)
11.48s
कुल लागत
$0.446
अनुशंसित मॉडल GPT-5.6 Sol (high)

It has the best score here (9.4), while responding about 3.8x faster than Muse Spark 1.3 (low).

विस्तृत तुलना

मेट्रिक Muse Spark 1.3 Muse Spark 1.3 low रिलीज़: 2026-09-02 GPT-5.6 Sol GPT-5.6 Sol high रिलीज़: 2026-07-09
स्कोर 9.0 9.4
रैंक #25 #10
विश्वसनीयता 9.6 10.0
संगति 9.0 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 89.4%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 3.720 6.987
कुल लागत $0.633 $0.446
इनपुट कीमत $1.250 / 1M $2.000 / 1M
आउटपुट कीमत $4.250 / 1M $10.000 / 1M
कुल इनपुट टोकन 104,966 79,258
आउटपुट टोकन 10,208 4,855
रीजनिंग टोकन 107,707 23,853
प्रतिक्रिया समय (औसत) 43.67s 11.48s
प्रतिक्रिया समय (अधिकतम) 190.38s 54.79s
प्रतिक्रिया समय (कुल) 960.70s 252.62s
पैरामीटर ~1T कुल (~50B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Muse Spark 1.3

low
लागत
$0.017
समय
83.9s
टोकन
3,959 tok

#10 GPT-5.6 Sol

high
लागत
$0.151
समय
201.9s
टोकन
5,100 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Spark 1.3 10.0 10.0 100.0% 0 53.93s 7,275 1,047 21,679
GPT-5.6 Sol 10.0 10.0 100.0% 0 12.52s 7,302 404 5,656

त्वरित तुलना

तुलना जोड़ी बदलें