नेव्हिगेशन
AI BENCHY
Advertise here

Muse Spark 1.2 (high) vs GPT-5.5 (low)

GPT-5.5 (low) average score मध्ये पुढे आहे: 9.3 vs 8.7. GPT-5.5 (low) चा benchmark खर्च कमी आहे: $1.257 vs $1.771. GPT-5.5 (low) वेगवान आहे: 10.15s vs 26.59s, pass rates 74.2% vs 86.4%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-20

क्रमांक
#30
एकूण आउटपुट टोकन्स
382,087
प्रतिसाद वेळ (सरासरी)
26.59s
एकूण खर्च
$1.771
क्रमांक
#10
एकूण आउटपुट टोकन्स
28,540
प्रतिसाद वेळ (सरासरी)
10.15s
एकूण खर्च
$1.257
शिफारस केलेले मॉडेल GPT-5.5 (low)

It has the best score here (9.3), while responding about 2.6x faster than Muse Spark 1.2 (high).

तपशीलवार तुलना

मेट्रिक Muse Spark 1.2 Muse Spark 1.2 high प्रकाशन: 2026-08-06 GPT-5.5 GPT-5.5 low प्रकाशन: 2026-04-24
स्कोअर 8.7 9.3
क्रमांक #30 #10
विश्वसनीयता 9.9 10.0
सुसंगतता 8.3 10.0
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 74.2% 86.4%
अस्थिर चाचण्या 5 0
एकूण रन 66 66
प्रति निकाल खर्च 12.645 6.614
एकूण खर्च $1.771 $1.257
इनपुट किंमत $1.250 / 1M $5.000 / 1M
आउटपुट किंमत $4.250 / 1M $30.000 / 1M
एकूण इनपुट टोकन्स 117,037 80,067
आउटपुट टोकन्स 6,983 5,378
रिझनिंग टोकन्स 375,104 23,162
प्रतिसाद वेळ (सरासरी) 26.59s 10.15s
प्रतिसाद वेळ (कमाल) 192.00s 56.19s
प्रतिसाद वेळ (एकूण) 584.89s 223.24s
पॅरामीटर्स ~1T एकूण (~50B सक्रिय) ~1.5T एकूण (~100B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 Muse Spark 1.2

high
खर्च
$0.057
वेळ
34.7s
टोकन्स
13,356 tok

#10 GPT-5.5

low
खर्च
$0.068
वेळ
37.0s
टोकन्स
2,339 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Muse Spark 1.2 10.0 10.0 100.0% 0 22.24s 7,275 351 47,857
GPT-5.5 10.0 10.0 100.0% 0 15.04s 7,302 423 6,402

झटपट तुलना

तुलना जोडी बदला