नेविगेशन
AI BENCHY
Advertise here

Muse Spark 1.3 (high) vs GPT-5.6 Sol (medium)

GPT-5.6 Sol (medium) average score में आगे है: 9.4 vs 9.0. GPT-5.6 Sol (medium) की benchmark लागत कम है: $0.508 vs $1.252. GPT-5.6 Sol (medium) तेज है: 12.63s vs 117.06s, pass rates 81.8% vs 90.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#24
कुल आउटपुट टोकन
265,177
प्रतिक्रिया समय (औसत)
117.06s
कुल लागत
$1.252
रैंक
#9
कुल आउटपुट टोकन
34,977
प्रतिक्रिया समय (औसत)
12.63s
कुल लागत
$0.508
अनुशंसित मॉडल GPT-5.6 Sol (medium)

It has the best score here (9.4), while costing about 2.5x less than Muse Spark 1.3 (high).

विस्तृत तुलना

मेट्रिक Muse Spark 1.3 Muse Spark 1.3 high रिलीज़: 2026-09-02 GPT-5.6 Sol GPT-5.6 Sol medium रिलीज़: 2026-07-09
स्कोर 9.0 9.4
रैंक #24 #9
विश्वसनीयता 9.5 10.0
संगति 8.9 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 81.8% 90.9%
अस्थिर टेस्ट 3 3
कुल रन 66 66
प्रति परिणाम लागत 7.361 8.025
कुल लागत $1.252 $0.508
इनपुट कीमत $1.250 / 1M $2.000 / 1M
आउटपुट कीमत $4.250 / 1M $10.000 / 1M
कुल इनपुट टोकन 99,477 79,006
आउटपुट टोकन 14,053 4,696
रीजनिंग टोकन 251,124 30,281
प्रतिक्रिया समय (औसत) 117.06s 12.63s
प्रतिक्रिया समय (अधिकतम) 470.12s 79.40s
प्रतिक्रिया समय (कुल) 2575.43s 277.88s
पैरामीटर ~1T कुल (~50B सक्रिय) ~2T कुल (~150B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#24 Muse Spark 1.3

high
लागत
$0.050
समय
203.3s
टोकन
11,679 tok

#9 GPT-5.6 Sol

medium
लागत
$0.124
समय
57.2s
टोकन
4,199 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Spark 1.3 10.0 10.0 100.0% 0 146.96s 7,275 2,003 59,912
GPT-5.6 Sol 10.0 10.0 100.0% 0 9.40s 7,302 394 4,706

त्वरित तुलना

तुलना जोड़ी बदलें