নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Inception: Mercury 2 vs Xiaomi: MiMo-V2.5-Pro

সারাংশ

Mercury 2 vs MiMo-V2.5-Pro benchmark তুলনা: MiMo-V2.5-Pro average score-এ এগিয়ে: 5.5 vs 4.6. Mercury 2-এর benchmark খরচ কম: $0.011 vs $0.017. Mercury 2 দ্রুত: 653ms vs 1.78s, pass rates 23.8% vs 39.7%.

প্রস্তাবিত মডেল: Mercury 2 - It offers the best overall trade-off: a competitive score (4.6), lower cost than MiMo-V2.5-Pro, and balanced response time.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-18

মেট্রিক Mercury 2 Mercury 2 none প্রকাশ: 2026-02-24 MiMo-V2.5-Pro MiMo-V2.5-Pro none প্রকাশ: 2026-04-22
স্কোর 4.6 5.5
র‍্যাঙ্ক #151 #119
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.2 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 23.8% 39.7%
অস্থির টেস্ট 2 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 0.259 0.648
মোট খরচ $0.011 $0.017
ইনপুট মূল্য $0.250 / 1M $0.435 / 1M
আউটপুট মূল্য $0.750 / 1M $0.870 / 1M
মোট ইনপুট টোকেন 28,113 30,724
আউটপুট টোকেন 4,439 3,043
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 653ms 1.78s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 1.43s 8.32s
প্রতিক্রিয়া সময় (মোট) 13.72s 37.42s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#151 Mercury 2

none
খরচ
$0.002
সময়
1.8s
টোকেন
1,514 tok

#119 MiMo-V2.5-Pro

none
খরচ
$0.004
সময়
46.4s
টোকেন
4,025 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.0 10.0 0.0% 0 483ms 631 286 0
MiMo-V2.5-Pro 3.3 8.1 8.3% 1 2.67s 645 994 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.4 9.6 0.0% 0 1.03s 7,229 3,088 0
MiMo-V2.5-Pro 4.3 7.8 22.2% 1 1.41s 6,559 485 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.0 10.0 0.0% 0 606ms 4,821 131 0
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 3.54s 4,695 596 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 7.3 5.9 83.3% 1 667ms 6,362 180 0
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 1.32s 7,758 249 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 5.3 7.2 44.4% 1 534ms 784 46 0
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 877ms 753 27 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 4.8 10.0 0.0% 0 628ms 495 159 0
MiMo-V2.5-Pro 4.0 10.0 0.0% 0 2.58s 498 87 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 6.5 10.0 50.0% 0 551ms 691 82 0
MiMo-V2.5-Pro 6.4 10.0 50.0% 0 1.03s 684 66 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.1 10.0 0.0% 0 535ms 694 251 0
MiMo-V2.5-Pro 6.7 4.7 77.8% 2 1.30s 678 267 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.27s 6,193 197 0
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 3.30s 8,238 258 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.0 10.0 0.0% 0 548ms 213 19 0
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 1.89s 216 14 0

দ্রুত তুলনা

তুলনার জুটি বদলান