নেভিগেশন
AI BENCHY
Your ad here

AI BENCHY Compare

Inception: Mercury 2 vs Laguna M.1

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-04-29

মেট্রিক Mercury 2 Mercury 2 medium প্রকাশ: 2026-02-24 Laguna M.1 Laguna M.1 medium প্রকাশ: 2026-04-28 বিনামূল্যে উপলভ্য
স্কোর 6.5 6.3
র‍্যাঙ্ক #71 #74
নির্ভরযোগ্যতা প্রযোজ্য নয় 10.0
ধারাবাহিকতা 8.6 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 53.7% 53.7%
অস্থির টেস্ট 3 3
মোট রান 54 54
প্রতি ফলাফলে খরচ 0.580 0.000
মোট খরচ $0.047 $0.000
???? ??? $0.250 / 1M $0.000 / 1M
????? ??? $0.750 / 1M $0.000 / 1M
আউটপুট টোকেন 3,972 63,822
রিজনিং টোকেন 48,333 0
প্রতিক্রিয়া সময় (গড়) 2.21s 13.90s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 14.63s 53.14s
প্রতিক্রিয়া সময় (মোট) 37.51s 250.28s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 6.9 9.9 50.0% 0 1.12s 2,546 2,609
Laguna M.1 6.6 10.0 50.0% 0 9.15s 7,839 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.53s 249 2,213
Laguna M.1 4.3 1.1 66.7% 1 35.61s 14,327 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 3.28s 268 4,887
Laguna M.1 3.0 10.0 0.0% 0 53.14s 12,272 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 7.3 5.9 83.3% 1 1.11s 183 1,656
Laguna M.1 10.0 10.0 100.0% 0 4.93s 2,296 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 2.9 7.2 11.1% 1 6.48s 41 30,754
Laguna M.1 5.3 7.2 44.4% 1 24.14s 19,020 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 4.8 10.0 0.0% 0 821ms 137 542
Laguna M.1 4.1 10.0 0.0% 0 6.86s 1,294 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.07s 14 958
Laguna M.1 10.0 10.0 100.0% 0 4.30s 1,626 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.9 7.5 22.2% 1 934ms 354 2,758
Laguna M.1 3.6 7.2 22.2% 1 6.97s 3,978 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.89s 180 1,956
Laguna M.1 10.0 10.0 100.0% 0 6.31s 1,170 0

দ্রুত তুলনা

তুলনার জুটি বদলান