নেভিগেশন
Advertise here

Mercury 2.5 (low) vs GPT-4o-mini

Mercury 2.5 (low) average score-এ এগিয়ে: 5.1 vs 5.0. GPT-4o-mini-এর benchmark খরচ কম: $0.010 vs $0.011. Mercury 2.5 (low) দ্রুত: 1.35s vs 1.92s, pass rates 39.4% vs 22.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-08

তুলনা করা মডেল

র‍্যাঙ্ক
#265
মোট আউটপুট টোকেন
33,719
প্রতিক্রিয়া সময় (গড়)
1.35s
মোট খরচ
$0.011
র‍্যাঙ্ক
#274
মোট আউটপুট টোকেন
2,913
প্রতিক্রিয়া সময় (গড়)
1.92s
মোট খরচ
$0.010
প্রস্তাবিত মডেল Mercury 2.5 (low)

It has the strongest score in this comparison (5.1) and the best overall balance of cost and response time across all 2 models.

বিস্তারিত তুলনা

মেট্রিক Mercury 2.5 Mercury 2.5 low প্রকাশ: 2026-09-08 GPT-4o-mini GPT-4o-mini none প্রকাশ: 2024-07-18
স্কোর 5.1 5.0
র‍্যাঙ্ক #265 #274
নির্ভরযোগ্যতা 9.8 10.0
ধারাবাহিকতা 8.1 9.9
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 39.4% 22.7%
অস্থির টেস্ট 5 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.177 0.195
মোট খরচ $0.011 $0.010
ইনপুট মূল্য $0.040 / 1M $0.150 / 1M
আউটপুট মূল্য $0.150 / 1M $0.600 / 1M
মোট ইনপুট টোকেন 138,020 53,145
আউটপুট টোকেন 6,083 2,913
রিজনিং টোকেন 27,636 0
প্রতিক্রিয়া সময় (গড়) 1.35s 1.92s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 7.48s 7.58s
প্রতিক্রিয়া সময় (মোট) 29.74s 30.71s
প্যারামিটার ~100B ~8B
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#265 Mercury 2.5

low
খরচ
$0.001
সময়
2.4s
টোকেন
1,236 tok

#274 GPT-4o-mini

none
খরচ
$0.001
সময়
6.6s
টোকেন
742 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2.5 5.5 10.0 33.3% 0 972ms 7,909 521 2,269
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0

দ্রুত তুলনা

তুলনার জুটি বদলান