নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Inception: Mercury 2 vs MiniMax: MiniMax M2.5

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-03

মেট্রিক Mercury 2 Mercury 2 none প্রকাশ: 2026-02-24 MiniMax M2.5 MiniMax M2.5 medium প্রকাশ: 2026-02-12
স্কোর 4.6 5.5
র‍্যাঙ্ক #153 #125
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.1 6.4
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 25.0% 48.3%
অস্থির টেস্ট 2 9
মোট রান 60 60
প্রতি ফলাফলে খরচ 0.216 6.075
মোট খরচ $0.009 $0.294
ইনপুট মূল্য $0.250 / 1M $0.150 / 1M
আউটপুট মূল্য $0.750 / 1M $1.150 / 1M
মোট ইনপুট টোকেন 25,515 41,948
আউটপুট টোকেন 3,001 109,492
রিজনিং টোকেন 0 251,674
প্রতিক্রিয়া সময় (গড়) 614ms 49.87s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 1.27s 237.27s
প্রতিক্রিয়া সময় (মোট) 12.28s 598.39s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.0 10.0 0.0% 0 483ms 631 286 0
MiniMax M2.5 7.9 6.3 83.3% 2 20.82s 612 286 45,344
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.5 9.4 0.0% 0 831ms 4,631 1,650 0
MiniMax M2.5 3.5 9.8 0.0% 0 125.80s 4,318 354 27,037
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.0 10.0 0.0% 0 606ms 4,821 131 0
MiniMax M2.5 4.5 2.1 66.7% 1 60.39s 21,104 740 9,713
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 7.3 5.9 83.3% 1 667ms 6,362 180 0
MiniMax M2.5 4.6 1.7 66.7% 2 7.48s 6,584 266 3,835
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 5.3 7.2 44.4% 1 534ms 784 46 0
MiniMax M2.5 2.9 4.4 22.2% 2 237.27s 308 105,047 133,487
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 4.8 10.0 0.0% 0 628ms 495 159 0
MiniMax M2.5 3.8 2.5 33.3% 1 6.63s 492 25 1,686
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 6.5 10.0 50.0% 0 551ms 691 82 0
MiniMax M2.5 7.5 10.0 50.0% 0 621ms 699 156 1,495
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.1 10.0 0.0% 0 535ms 694 251 0
MiniMax M2.5 5.3 7.2 44.4% 1 11.21s 495 1,069 9,605
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.27s 6,193 197 0
MiniMax M2.5 10.0 10.0 100.0% 0 15.35s 7,123 269 937
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.0 10.0 0.0% 0 548ms 213 19 0
MiniMax M2.5 3.0 10.0 0.0% 0 80.79s 213 1,280 18,535

দ্রুত তুলনা

তুলনার জুটি বদলান