नेविगेशन
AI BENCHY
Advertise here

Muse Spark 1.3 (low) vs GPT-5.3-Codex (medium)

average score लगभग बराबर है: 9.0 vs 8.9. Muse Spark 1.3 (low) की benchmark लागत कम है: $0.633 vs $0.988. GPT-5.3-Codex (medium) तेज है: 16.91s vs 43.67s, pass rates 83.3% vs 83.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-02

रैंक
#25
कुल आउटपुट टोकन
117,915
प्रतिक्रिया समय (औसत)
43.67s
कुल लागत
$0.633
रैंक
#28
कुल आउटपुट टोकन
60,374
प्रतिक्रिया समय (औसत)
16.91s
कुल लागत
$0.988
अनुशंसित मॉडल GPT-5.3-Codex (medium)

It has the best score here (8.9), while responding about 2.6x faster than Muse Spark 1.3 (low).

विस्तृत तुलना

मेट्रिक Muse Spark 1.3 Muse Spark 1.3 low रिलीज़: 2026-09-02 GPT-5.3-Codex GPT-5.3-Codex medium रिलीज़: 2026-02-05
स्कोर 9.0 8.9
रैंक #25 #28
विश्वसनीयता 9.6 10.0
संगति 9.0 8.6
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 83.3%
अस्थिर टेस्ट 3 4
कुल रन 66 66
प्रति परिणाम लागत 3.720 6.171
कुल लागत $0.633 $0.988
इनपुट कीमत $1.250 / 1M $1.750 / 1M
आउटपुट कीमत $4.250 / 1M $14.000 / 1M
कुल इनपुट टोकन 104,966 81,187
आउटपुट टोकन 10,208 6,258
रीजनिंग टोकन 107,707 54,116
प्रतिक्रिया समय (औसत) 43.67s 16.91s
प्रतिक्रिया समय (अधिकतम) 190.38s 100.93s
प्रतिक्रिया समय (कुल) 960.70s 372.03s
पैरामीटर ~1T कुल (~50B सक्रिय) ~1.2T कुल (~80B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#25 Muse Spark 1.3

low
लागत
$0.017
समय
83.9s
टोकन
3,959 tok

#28 GPT-5.3-Codex

medium
लागत
$0.049
समय
54.9s
टोकन
3,580 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Muse Spark 1.3 10.0 10.0 100.0% 0 53.93s 7,275 1,047 21,679
GPT-5.3-Codex 10.0 10.0 100.0% 0 19.50s 7,302 535 10,890

त्वरित तुलना

तुलना जोड़ी बदलें