নেভিগেশন
AI BENCHY
Advertise here

Mercury 2.5 Preview (medium) vs GPT 5.3 Chat

average score প্রায় সমান: 7.5 vs 7.5. Mercury 2.5 Preview (medium)-এর benchmark খরচ কম: $0.024 vs $0.533. Mercury 2.5 Preview (medium) দ্রুত: 3.58s vs 6.56s, pass rates 69.7% vs 65.2%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-02

র‍্যাঙ্ক
#91
মোট আউটপুট টোকেন
127,034
প্রতিক্রিয়া সময় (গড়)
3.58s
মোট খরচ
$0.024
র‍্যাঙ্ক
#88
মোট আউটপুট টোকেন
28,179
প্রতিক্রিয়া সময় (গড়)
6.56s
মোট খরচ
$0.533
প্রস্তাবিত মডেল Mercury 2.5 Preview (medium)

It has the best score here (7.5), while costing about 22.6x less than GPT 5.3 Chat.

বিস্তারিত তুলনা

মেট্রিক Mercury 2.5 Preview Mercury 2.5 Preview medium প্রকাশ: 2026-09-02 GPT 5.3 Chat GPT 5.3 Chat none প্রকাশ: 2026-03-03
স্কোর 7.5 7.5
র‍্যাঙ্ক #91 #88
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.6 8.6
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 69.7% 65.2%
অস্থির টেস্ট 1 4
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.158 4.097
মোট খরচ $0.024 $0.533
ইনপুট মূল্য $0.040 / 1M $1.750 / 1M
আউটপুট মূল্য $0.150 / 1M $14.000 / 1M
মোট ইনপুট টোকেন 112,713 78,846
আউটপুট টোকেন 5,436 28,179
রিজনিং টোকেন 121,598 0
প্রতিক্রিয়া সময় (গড়) 3.58s 6.56s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 17.84s 18.33s
প্রতিক্রিয়া সময় (মোট) 78.66s 137.77s
প্যারামিটার ~100B ~400B মোট (~17B সক্রিয়)
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#91 Mercury 2.5 Preview

medium
খরচ
$0.001
সময়
2.7s
টোকেন
2,241 tok

#88 GPT 5.3 Chat

none
খরচ
$0.008
সময়
8.1s
টোকেন
634 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2.5 Preview 7.8 10.0 66.7% 0 3.86s 7,839 552 22,126
GPT 5.3 Chat 5.6 4.7 55.6% 2 10.52s 7,302 6,632 0

দ্রুত তুলনা

তুলনার জুটি বদলান