नेविगेशन
AI BENCHY
Advertise here

Muse Spark 1.3 (medium) vs Grok 4.5 (high)

average score लगभग बराबर है: 9.0 vs 9.0. Muse Spark 1.3 (medium) की benchmark लागत कम है: $1.075 vs $2.252. Grok 4.5 (high) तेज है: 72.30s vs 89.78s, pass rates 81.8% vs 86.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#27
कुल आउटपुट टोकन
223,994
प्रतिक्रिया समय (औसत)
89.78s
कुल लागत
$1.075
रैंक
#26
कुल आउटपुट टोकन
324,462
प्रतिक्रिया समय (औसत)
72.30s
कुल लागत
$2.252
अनुशंसित मॉडल Muse Spark 1.3 (medium)

It has the best score here (9.0), while costing about 2.1x less than Grok 4.5 (high).

विस्तृत तुलना

मेट्रिक Muse Spark 1.3 Muse Spark 1.3 medium रिलीज़: 2026-09-02 Grok 4.5 Grok 4.5 high रिलीज़: 2026-07-08
स्कोर 9.0 9.0
रैंक #27 #26
विश्वसनीयता 9.3 10.0
संगति 8.5 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 81.8% 86.4%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 6.716 12.565
कुल लागत $1.075 $2.252
इनपुट कीमत $1.250 / 1M $2.000 / 1M
आउटपुट कीमत $4.250 / 1M $6.000 / 1M
कुल इनपुट टोकन 98,062 152,175
आउटपुट टोकन 13,168 5,655
रीजनिंग टोकन 210,826 318,807
प्रतिक्रिया समय (औसत) 89.78s 72.30s
प्रतिक्रिया समय (अधिकतम) 356.29s 676.83s
प्रतिक्रिया समय (कुल) 1975.17s 1590.56s
पैरामीटर ~1T कुल (~50B सक्रिय) ~1.7T कुल (~170B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#27 Muse Spark 1.3

medium
लागत
$0.025
समय
113.4s
टोकन
5,952 tok

#26 SpaceXAI: Grok 4.5

high
लागत
$0.015
समय
29.7s
टोकन
2,737 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Spark 1.3 10.0 10.0 100.0% 0 101.89s 7,275 1,374 43,595
Grok 4.5 10.0 10.0 100.0% 0 155.16s 9,579 357 100,752

त्वरित तुलना

तुलना जोड़ी बदलें