নেভিগেশন
AI BENCHY
Advertise here

Mercury 2.5 Preview (low) vs GPT-4o-mini

Mercury 2.5 Preview (low) average score-এ এগিয়ে: 5.0 vs 5.0. GPT-4o-mini-এর benchmark খরচ কম: $0.010 vs $0.011. Mercury 2.5 Preview (low) দ্রুত: 1.31s vs 1.92s, pass rates 47.0% vs 22.7%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-02

র‍্যাঙ্ক
#254
মোট আউটপুট টোকেন
31,975
প্রতিক্রিয়া সময় (গড়)
1.31s
মোট খরচ
$0.011
র‍্যাঙ্ক
#257
মোট আউটপুট টোকেন
2,913
প্রতিক্রিয়া সময় (গড়)
1.92s
মোট খরচ
$0.010
প্রস্তাবিত মডেল Mercury 2.5 Preview (low)

It has the strongest score in this comparison (5.0) and the best overall balance of cost and response time across all 2 models.

বিস্তারিত তুলনা

মেট্রিক Mercury 2.5 Preview Mercury 2.5 Preview low প্রকাশ: 2026-09-02 GPT-4o-mini GPT-4o-mini none প্রকাশ: 2024-07-18
স্কোর 5.0 5.0
র‍্যাঙ্ক #254 #257
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.0 9.9
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 47.0% 22.7%
অস্থির টেস্ট 8 0
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.169 0.195
মোট খরচ $0.011 $0.010
ইনপুট মূল্য $0.040 / 1M $0.150 / 1M
আউটপুট মূল্য $0.150 / 1M $0.600 / 1M
মোট ইনপুট টোকেন 133,525 53,145
আউটপুট টোকেন 7,259 2,913
রিজনিং টোকেন 24,716 0
প্রতিক্রিয়া সময় (গড়) 1.31s 1.92s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 7.29s 7.58s
প্রতিক্রিয়া সময় (মোট) 28.77s 30.71s
প্যারামিটার ~100B ~8B
উপলভ্যতা বন্ধ উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#254 Mercury 2.5 Preview

low
খরচ
$0.001
সময়
1.5s
টোকেন
1,169 tok

#257 GPT-4o-mini

none
খরচ
$0.001
সময়
6.6s
টোকেন
742 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2.5 Preview 5.5 10.0 33.3% 0 972ms 7,794 695 2,263
GPT-4o-mini 3.2 9.6 0.0% 0 1.63s 7,314 367 0

দ্রুত তুলনা

তুলনার জুটি বদলান