নেভিগেশন
Advertise here

Mercury 2.5 (high) vs GPT-5.5

Mercury 2.5 (high) average score-এ এগিয়ে: 7.1 vs 7.0. Mercury 2.5 (high)-এর benchmark খরচ কম: $0.031 vs $0.544. GPT-5.5 দ্রুত: 2.35s vs 4.32s, pass rates 62.1% vs 59.1%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-08

তুলনা করা মডেল

র‍্যাঙ্ক
#134
মোট আউটপুট টোকেন
174,547
প্রতিক্রিয়া সময় (গড়)
4.32s
মোট খরচ
$0.031
র‍্যাঙ্ক
#139
মোট আউটপুট টোকেন
4,915
প্রতিক্রিয়া সময় (গড়)
2.35s
মোট খরচ
$0.544
প্রস্তাবিত মডেল Mercury 2.5 (high)

It has the best score here (7.1), while costing about 17.6x less than GPT-5.5.

বিস্তারিত তুলনা

মেট্রিক Mercury 2.5 Mercury 2.5 high প্রকাশ: 2026-09-08 GPT-5.5 GPT-5.5 none প্রকাশ: 2026-04-24
স্কোর 7.1 7.0
র‍্যাঙ্ক #134 #139
নির্ভরযোগ্যতা 9.7 10.0
ধারাবাহিকতা 8.6 9.2
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 62.1% 59.1%
অস্থির টেস্ট 4 2
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.259 4.533
মোট খরচ $0.031 $0.544
ইনপুট মূল্য $0.040 / 1M $5.000 / 1M
আউটপুট মূল্য $0.150 / 1M $30.000 / 1M
মোট ইনপুট টোকেন 120,068 79,294
আউটপুট টোকেন 3,402 4,915
রিজনিং টোকেন 171,145 0
প্রতিক্রিয়া সময় (গড়) 4.32s 2.35s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 23.63s 12.24s
প্রতিক্রিয়া সময় (মোট) 95.06s 51.78s
প্যারামিটার ~100B ~1.5T মোট (~100B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#134 Mercury 2.5

high
খরচ
$0.001
সময়
3.5s
টোকেন
2,447 tok

#139 GPT-5.5

none
খরচ
$0.090
সময়
54.3s
টোকেন
3,063 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2.5 6.4 7.8 44.4% 1 6.58s 7,757 415 44,012
GPT-5.5 5.5 10.0 33.3% 0 1.35s 7,305 462 0

দ্রুত তুলনা

তুলনার জুটি বদলান