নেভিগেশন
AI BENCHY
Advertise here

AI BENCHY Compare

Inception: Mercury 2 vs Xiaomi: MiMo-V2.5-Pro

সারাংশ

Mercury 2 vs MiMo-V2.5-Pro benchmark তুলনা: Mercury 2 average score-এ এগিয়ে: 7.5 vs 7.4. Mercury 2-এর benchmark খরচ কম: $0.058 vs $0.106. Mercury 2 দ্রুত: 2.24s vs 26.13s, pass rates 54.0% vs 68.3%.

প্রস্তাবিত মডেল: Mercury 2 - It has the best score here (7.5), while costing about 1.8x less than MiMo-V2.5-Pro.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-12

মেট্রিক Mercury 2 Mercury 2 medium প্রকাশ: 2026-02-24 MiMo-V2.5-Pro MiMo-V2.5-Pro medium প্রকাশ: 2026-04-22
স্কোর 7.5 7.4
র‍্যাঙ্ক #46 #52
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.8 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 54.0% 68.3%
অস্থির টেস্ট 3 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 0.578 2.541
মোট খরচ $0.058 $0.106
ইনপুট মূল্য $0.250 / 1M $0.435 / 1M
আউটপুট মূল্য $0.750 / 1M $0.870 / 1M
মোট ইনপুট টোকেন 35,116 40,854
আউটপুট টোকেন 4,048 5,015
রিজনিং টোকেন 61,219 97,742
প্রতিক্রিয়া সময় (গড়) 2.24s 26.13s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 14.63s 130.77s
প্রতিক্রিয়া সময় (মোট) 44.72s 548.65s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#46 Mercury 2

medium
Cost
$0.002
Time
2.1s
Tokens
1,702 tok

#52 MiMo-V2.5-Pro

medium
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 6.9 9.9 50.0% 0 1.12s 554 2,546 2,609
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 3.26s 621 323 1,179
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 8.2 7.7 77.8% 1 2.04s 7,065 296 11,328
MiMo-V2.5-Pro 6.2 4.7 66.7% 2 92.07s 6,543 780 51,218
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 3.28s 12,909 268 4,887
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 53.36s 15,060 348 11,870
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 7.3 5.9 83.3% 1 1.11s 6,234 183 1,656
MiMo-V2.5-Pro 7.3 5.8 83.3% 1 18.81s 7,746 260 8,383
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 2.9 7.2 11.1% 1 6.48s 695 41 30,754
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 37.87s 630 275 17,023
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 4.8 10.0 0.0% 0 821ms 456 137 542
MiMo-V2.5-Pro 5.5 10.0 0.0% 0 4.02s 492 155 163
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.07s 340 14 958
MiMo-V2.5-Pro 9.9 10.0 100.0% 0 2.77s 672 82 803
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 5.4 10.0 33.3% 0 949ms 601 361 2,781
MiMo-V2.5-Pro 6.7 7.9 55.6% 1 5.31s 660 540 2,181
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 10.0 10.0 100.0% 0 1.89s 6,080 180 1,956
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 16.87s 8,220 311 2,908
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Mercury 2 3.0 10.0 0.0% 0 2.58s 182 22 3,748
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 12.46s 210 1,941 2,014

দ্রুত তুলনা

তুলনার জুটি বদলান