নেভিগেশন
AI BENCHY
Advertise here

Muse Spark 1.2 (low) vs GPT-5.2 (medium)

Muse Spark 1.2 (low) average score-এ এগিয়ে: 8.4 vs 8.4. Muse Spark 1.2 (low)-এর benchmark খরচ কম: $0.650 vs $0.951. Muse Spark 1.2 (low) দ্রুত: 9.67s vs 22.62s, pass rates 77.3% vs 72.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-08-05

র‍্যাঙ্ক
#30
মোট আউটপুট টোকেন
122,939
প্রতিক্রিয়া সময় (গড়)
9.67s
মোট খরচ
$0.650
র‍্যাঙ্ক
#33
মোট আউটপুট টোকেন
54,782
প্রতিক্রিয়া সময় (গড়)
22.62s
মোট খরচ
$0.951
প্রস্তাবিত মডেল Muse Spark 1.2 (low)

It has the best score here (8.4), while responding about 2.3x faster than GPT-5.2 (medium).

বিস্তারিত তুলনা

মেট্রিক Muse Spark 1.2 Muse Spark 1.2 low প্রকাশ: 2026-08-06 GPT-5.2 GPT-5.2 medium প্রকাশ: 2025-12-11
স্কোর 8.4 8.4
র‍্যাঙ্ক #30 #33
নির্ভরযোগ্যতা 9.9 10.0
ধারাবাহিকতা 9.0 8.5
বেঞ্চমার্ক কভারেজ 22/22 টেস্ট · 66/66 প্রচেষ্টা 22/22 টেস্ট · 66/66 প্রচেষ্টা
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 77.3% 72.7%
অস্থির টেস্ট 3 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 4.332 6.791
মোট খরচ $0.650 $0.951
ইনপুট মূল্য $1.250 / 1M $1.750 / 1M
আউটপুট মূল্য $4.250 / 1M $14.000 / 1M
মোট ইনপুট টোকেন 101,802 105,004
আউটপুট টোকেন 8,025 9,914
রিজনিং টোকেন 114,914 44,868
প্রতিক্রিয়া সময় (গড়) 9.67s 22.62s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 47.80s 102.93s
প্রতিক্রিয়া সময় (মোট) 212.82s 339.28s

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#30 Muse Spark 1.2

low
খরচ
$0.019
সময়
14.6s
টোকেন
4,384 tok

#33 GPT-5.2

medium
খরচ
$0.047
সময়
49.2s
টোকেন
3,396 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Muse Spark 1.2 8.4 7.4 88.9% 1 10.09s 7,275 343 19,717
GPT-5.2 10.0 10.0 100.0% 0 22.73s 7,302 511 11,912

দ্রুত তুলনা

তুলনার জুটি বদলান