নেভিগেশন
Advertise here

Mercury 2.5 (low) vs Laguna S 2.1 (medium)

Mercury 2.5 (low) average score-এ এগিয়ে: 5.1 vs 5.0. Mercury 2.5 (low)-এর benchmark খরচ কম: $0.020 vs $0.080. Mercury 2.5 (low) দ্রুত: 3.34s vs 63.06s, pass rates 37.7% vs 24.6%.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-10-01

তুলনা করা মডেল

র‍্যাঙ্ক
#293
মোট আউটপুট টোকেন
40,302
প্রতিক্রিয়া সময় (গড়)
3.34s
মোট খরচ
$0.020
র‍্যাঙ্ক
#296
মোট আউটপুট টোকেন
386,824
প্রতিক্রিয়া সময় (গড়)
63.06s
মোট খরচ
$0.080
প্রস্তাবিত মডেল Mercury 2.5 (low)

It has the best score here (5.1), while costing about 4.2x less than Laguna S 2.1 (medium).

বিস্তারিত তুলনা

মেট্রিক Mercury 2.5 Mercury 2.5 low প্রকাশ: 2026-09-08 Laguna S 2.1 Laguna S 2.1 medium প্রকাশ: 2026-07-21 বিনামূল্যে উপলভ্য
স্কোর 5.1 5.0
র‍্যাঙ্ক #293 #296
নির্ভরযোগ্যতা 9.8 10.0
ধারাবাহিকতা 8.2 8.5
প্রচেষ্টা 69/69 69/69
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 37.7% 24.6%
অস্থির টেস্ট 5 4
মোট রান 69 69
প্রতি ফলাফলে খরচ 0.319 1.987
মোট খরচ $0.020 $0.080
ইনপুট মূল্য $0.040 / 1M $0.090 / 1M
আউটপুট মূল্য $0.150 / 1M $0.180 / 1M
মোট ইনপুট টোকেন 326,083 230,291
আউটপুট টোকেন 7,224 99,030
রিজনিং টোকেন 33,078 287,794
প্রতিক্রিয়া সময় (গড়) 3.34s 63.06s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 47.06s 560.31s
প্রতিক্রিয়া সময় (মোট) 76.80s 1450.31s
প্যারামিটার ~100B 118B মোট (8B সক্রিয়)
উপলভ্যতা বন্ধ উৎস ওজন উপলভ্য

মডেল জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#293 Mercury 2.5

low
খরচ
$0.001
সময়
2.4s
টোকেন
1,236 tok

#296 Laguna S 2.1

medium
খরচ
$0.001
সময়
4.0s
টোকেন
867 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2.5 5.5 10.0 33.3% 0 972ms 7,909 521 2,269
Laguna S 2.1 5.3 7.2 44.4% 1 158.98s 7,917 93,354 106,718

দ্রুত তুলনা

তুলনার জুটি বদলান