নেভিগেশন
Advertise here

Command A+ (high) vs Mercury 2.5

Mercury 2.5 average score-এ এগিয়ে: 3.9 vs 3.0. Command A+ (high)-এর benchmark খরচ কম: $0.000 vs $0.016. Mercury 2.5 দ্রুত: 2.45s vs 86.95s, pass rates 0.0% vs 25.8%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-09-23

তুলনা করা মডেল

র‍্যাঙ্ক
#353
মোট আউটপুট টোকেন
0
প্রতিক্রিয়া সময় (গড়)
86.95s
মোট খরচ
$0.000
র‍্যাঙ্ক
#342
মোট আউটপুট টোকেন
71,143
প্রতিক্রিয়া সময় (গড়)
2.45s
মোট খরচ
$0.016
প্রস্তাবিত মডেল Mercury 2.5

It has the best score here (3.9), while responding about 35.5x faster than Command A+ (high).

বিস্তারিত তুলনা

মেট্রিক Command A+ Command A+ high প্রকাশ: 2026-09-23 Mercury 2.5 Mercury 2.5 none প্রকাশ: 2026-09-08
স্কোর 3.0 3.9
র‍্যাঙ্ক #353 #342
নির্ভরযোগ্যতা 0.0 10.0
ধারাবাহিকতা 10.0 7.5
প্রচেষ্টা 66/66 66/66
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 0.0% 25.8%
অস্থির টেস্ট 0 7
মোট রান 66 66
প্রতি ফলাফলে খরচ 0.000 0.782
মোট খরচ $0.000 $0.016
ইনপুট মূল্য $0.300 / 1M $0.040 / 1M
আউটপুট মূল্য $1.500 / 1M $0.150 / 1M
মোট ইনপুট টোকেন 0 123,740
আউটপুট টোকেন 0 71,143
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 86.95s 2.45s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 114.87s 36.48s
প্রতিক্রিয়া সময় (মোট) 1913.01s 53.83s
প্যারামিটার 218B মোট (25B সক্রিয়) ~100B
উপলভ্যতা উন্মুক্ত উৎস বন্ধ উৎস

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#353 Command A+

high
Provider returned error
খরচ
$0.000
সময়
0.2s
টোকেন
0 tok

#342 Mercury 2.5

none
খরচ
$0.001
সময়
2.7s
টোকেন
2,749 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Command A+ 3.0 10.0 0.0% 0 92.74s 0 0 0
Mercury 2.5 3.7 7.0 22.2% 1 12.50s 7,888 61,297 0

দ্রুত তুলনা

তুলনার জুটি বদলান