नेविगेशन
AI BENCHY
Advertise here

Muse Spark 1.2 (medium) vs Grok 4.5 (low)

Muse Spark 1.2 (medium) average score में आगे है: 8.6 vs 8.4. Grok 4.5 (low) की benchmark लागत कम है: $0.935 vs $1.227. Grok 4.5 (low) तेज है: 15.56s vs 17.47s, pass rates 74.2% vs 75.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-05

रैंक
#25
कुल आउटपुट टोकन
252,312
प्रतिक्रिया समय (औसत)
17.47s
कुल लागत
$1.227
रैंक
#32
कुल आउटपुट टोकन
113,951
प्रतिक्रिया समय (औसत)
15.56s
कुल लागत
$0.935
अनुशंसित मॉडल Grok 4.5 (low)

It offers the best overall trade-off: a competitive score (8.4), lower cost than Muse Spark 1.2 (medium), and balanced response time.

विस्तृत तुलना

मेट्रिक Muse Spark 1.2 Muse Spark 1.2 medium रिलीज़: 2026-08-06 Grok 4.5 Grok 4.5 low रिलीज़: 2026-07-08
स्कोर 8.6 8.4
रैंक #25 #32
विश्वसनीयता 9.9 10.0
संगति 8.7 9.7
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 74.2% 75.8%
अस्थिर टेस्ट 4 1
कुल रन 66 66
प्रति परिणाम लागत 8.764 5.844
कुल लागत $1.227 $0.935
इनपुट कीमत $1.250 / 1M $2.000 / 1M
आउटपुट कीमत $4.250 / 1M $6.000 / 1M
कुल इनपुट टोकन 123,671 125,596
आउटपुट टोकन 7,222 7,505
रीजनिंग टोकन 245,090 106,446
प्रतिक्रिया समय (औसत) 17.47s 15.56s
प्रतिक्रिया समय (अधिकतम) 142.49s 205.28s
प्रतिक्रिया समय (कुल) 384.44s 342.32s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Muse Spark 1.2

medium
लागत
$0.033
समय
21.8s
टोकन
7,846 tok

#32 xAI: Grok 4.5

low
लागत
$0.011
समय
12.4s
टोकन
2,018 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Spark 1.2 10.0 10.0 100.0% 0 17.49s 7,275 353 33,215
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641

त्वरित तुलना

तुलना जोड़ी बदलें