नेविगेशन
AI BENCHY
Advertise here

Muse Spark 1.2 (high) vs GPT-5.5 (medium)

GPT-5.5 (medium) average score में आगे है: 9.0 vs 8.8. Muse Spark 1.2 (high) की benchmark लागत कम है: $1.632 vs $4.137. Muse Spark 1.2 (high) तेज है: 23.99s vs 38.42s, pass rates 75.8% vs 87.9%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-05

रैंक
#20
कुल आउटपुट टोकन
349,571
प्रतिक्रिया समय (औसत)
23.99s
कुल लागत
$1.632
रैंक
#15
कुल आउटपुट टोकन
124,436
प्रतिक्रिया समय (औसत)
38.42s
कुल लागत
$4.137
अनुशंसित मॉडल Muse Spark 1.2 (high)

Its score stays close to the best score here (8.8 vs 9.0), while costing about 2.5x less than GPT-5.5 (medium).

विस्तृत तुलना

मेट्रिक Muse Spark 1.2 Muse Spark 1.2 high रिलीज़: 2026-08-06 GPT-5.5 GPT-5.5 medium रिलीज़: 2026-04-24
स्कोर 8.8 9.0
रैंक #20 #15
विश्वसनीयता 9.8 10.0
संगति 8.7 8.9
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 75.8% 87.9%
अस्थिर टेस्ट 4 3
कुल रन 66 66
प्रति परिणाम लागत 10.880 22.980
कुल लागत $1.632 $4.137
इनपुट कीमत $1.250 / 1M $5.000 / 1M
आउटपुट कीमत $4.250 / 1M $30.000 / 1M
कुल इनपुट टोकन 117,028 80,659
आउटपुट टोकन 6,983 5,617
रीजनिंग टोकन 342,588 118,819
प्रतिक्रिया समय (औसत) 23.99s 38.42s
प्रतिक्रिया समय (अधिकतम) 192.00s 332.10s
प्रतिक्रिया समय (कुल) 527.70s 845.35s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#20 Muse Spark 1.2

high
लागत
$0.057
समय
34.7s
टोकन
13,356 tok

#15 GPT-5.5

medium
लागत
$0.112
समय
71.9s
टोकन
3,807 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Spark 1.2 10.0 10.0 100.0% 0 22.24s 7,275 351 47,857
GPT-5.5 8.8 7.8 88.9% 1 59.77s 7,305 362 24,959

त्वरित तुलना

तुलना जोड़ी बदलें