नेव्हिगेशन
AI BENCHY
Advertise here

Muse Spark 1.1 (low) vs Qwen3.8 27B (high)

Qwen3.8 27B (high) average score मध्ये पुढे आहे: 8.4 vs 8.3. स्थानिक हार्डवेअरचा खर्च मोजला नाही, त्यामुळे खर्चाची तुलना उपलब्ध नाही. Muse Spark 1.1 (low) वेगवान आहे: 11.89s vs 167.89s, pass rates 71.2% vs 77.3%.

AI BENCHY टेस्ट सूटमधून बेंचमार्क या वेळी तयार झाले: 2026-08-15

क्रमांक
#45
एकूण आउटपुट टोकन्स
116,489
प्रतिसाद वेळ (सरासरी)
11.89s
एकूण खर्च
$0.673
क्रमांक
#42
एकूण आउटपुट टोकन्स
656,635
प्रतिसाद वेळ (सरासरी)
167.89s
एकूण खर्च
लागू नाही
शिफारस केलेले मॉडेल Muse Spark 1.1 (low)

Its score stays close to the best score here (8.3 vs 8.4), while responding about 14.1x faster than Qwen3.8 27B (high).

तपशीलवार तुलना

मेट्रिक Muse Spark 1.1 Muse Spark 1.1 low प्रकाशन: 2026-07-16 Qwen3.8 27B Qwen3.8 27B high प्रकाशन: 2026-08-14
स्कोअर 8.3 8.4
क्रमांक #45 #42
विश्वसनीयता 10.0 9.6
सुसंगतता 8.5 9.2
प्रयत्न 66/66 66/66
बरोबर चाचण्या
प्रति प्रयत्न पास दर 71.2% 77.3%
अस्थिर चाचण्या 4 2
एकूण रन 66 66
प्रति निकाल खर्च 5.173 लागू नाही
एकूण खर्च $0.673 लागू नाही
इनपुट किंमत $1.250 / 1M लागू नाही
आउटपुट किंमत $4.250 / 1M लागू नाही
एकूण इनपुट टोकन्स 141,878 100,179
आउटपुट टोकन्स 11,033 904
रिझनिंग टोकन्स 105,456 655,731
प्रतिसाद वेळ (सरासरी) 11.89s 167.89s
प्रतिसाद वेळ (कमाल) 54.15s 640.85s
प्रतिसाद वेळ (एकूण) 261.69s 3693.54s
पॅरामीटर्स ~1T एकूण (~50B सक्रिय) 27.3B
उपलब्धता बंद स्रोत वेट्स उपलब्ध

मॉडेल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#45 Muse Spark 1.1

low
खर्च
$0.020
वेळ
39.2s
टोकन्स
4,947 tok

#42 Qwen3.8 27B

high
खर्च
लागू नाही
वेळ
270.1s
टोकन्स
18,963 tok

स्कोअरनुसार शीर्ष मॉडेल्स

स्कोअर विरुद्ध एकूण खर्च

प्रतिसाद वेळ (सरासरी)

स्कोअर vs प्रतिसाद वेळ (सरासरी)

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

श्रेणीवार तपशील

कोडिंग स्कोअर सुसंगतता प्रति प्रयत्न पास दर अस्थिर चाचण्या बरोबर चाचण्या प्रतिसाद वेळ (सरासरी) इनपुट टोकन्स आउटपुट टोकन्स रिझनिंग टोकन्स
Muse Spark 1.1 10.0 10.0 100.0% 0 10.34s 8,562 394 14,503
Qwen3.8 27B 8.1 7.0 88.9% 1 248.62s 8,235 346 143,335

झटपट तुलना

तुलना जोडी बदला

GPT-5.2mediumvsQwen3.8 27BhighSeed 2.1 TurbomediumvsQwen3.8 27BhighQwen3.8 27BhighvsGrok 4.5lowQwen3.8 27BhighvsGrok 4.6mediumMuse Spark 1.2lowvsQwen3.8 27BhighMuse Spark 1.1lowvsInkling SmallhighGemini 2.5 FlashmediumvsMuse Spark 1.1lowQwen3.8 27BhighvsGrok 4.5mediumSeed 2.1 TurbomediumvsMuse Spark 1.1lowMuse Spark 1.1lowvsGPT-5.2mediumClaude Sonnet 5mediumvsMuse Spark 1.1lowMuse Spark 1.1lowvsGrok 4.6medium