नेविगेशन
AI BENCHY
Advertise here

Muse Spark 1.1 (high) vs GPT-5.2 Chat

Muse Spark 1.1 (high) average score में आगे है: 8.0 vs 7.9. GPT-5.2 Chat की benchmark लागत कम है: $0.594 vs $1.709. GPT-5.2 Chat तेज है: 7.73s vs 30.84s, pass rates 68.2% vs 69.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-29

रैंक
#53
कुल आउटपुट टोकन
363,989
प्रतिक्रिया समय (औसत)
30.84s
कुल लागत
$1.709
रैंक
#60
कुल आउटपुट टोकन
29,742
प्रतिक्रिया समय (औसत)
7.73s
कुल लागत
$0.594
अनुशंसित मॉडल GPT-5.2 Chat

Its score stays close to the best score here (7.9 vs 8.0), while costing about 2.9x less than Muse Spark 1.1 (high).

विस्तृत तुलना

मेट्रिक Muse Spark 1.1 Muse Spark 1.1 high रिलीज़: 2026-07-16 GPT-5.2 Chat GPT-5.2 Chat none रिलीज़: 2025-12-11
स्कोर 8.0 7.9
रैंक #53 #60
विश्वसनीयता 10.0 10.0
संगति 7.9 8.6
प्रयास 64/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 68.2% 69.7%
अस्थिर टेस्ट 6 4
कुल रन 64 66
प्रति परिणाम लागत 14.236 4.564
कुल लागत $1.709 $0.594
इनपुट कीमत $1.250 / 1M $1.750 / 1M
आउटपुट कीमत $4.250 / 1M $14.000 / 1M
कुल इनपुट टोकन 129,003 101,104
आउटपुट टोकन 8,340 29,742
रीजनिंग टोकन 355,649 0
प्रतिक्रिया समय (औसत) 30.84s 7.73s
प्रतिक्रिया समय (अधिकतम) 196.03s 38.52s
प्रतिक्रिया समय (कुल) 647.67s 162.40s
पैरामीटर ~1T कुल (~50B सक्रिय) ~400B कुल (~17B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#53 Muse Spark 1.1

high
लागत
$0.039
समय
50.1s
टोकन
9,423 tok

#60 GPT-5.2 Chat

none
लागत
$0.010
समय
15.3s
टोकन
797 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Spark 1.1 10.0 10.0 100.0% 0 22.92s 8,562 349 36,039
GPT-5.2 Chat 8.8 7.8 88.9% 1 9.82s 7,305 6,731 0

त्वरित तुलना

तुलना जोड़ी बदलें