নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

DeepSeek: DeepSeek V4 Pro vs Xiaomi: MiMo-V2.5-Pro

সারাংশ

DeepSeek V4 Pro vs MiMo-V2.5-Pro benchmark তুলনা: DeepSeek V4 Pro average score-এ এগিয়ে: 7.6 vs 7.4. MiMo-V2.5-Pro-এর benchmark খরচ কম: $0.106 vs $0.157. MiMo-V2.5-Pro দ্রুত: 26.13s vs 77.20s, pass rates 66.7% vs 68.3%.

প্রস্তাবিত মডেল: MiMo-V2.5-Pro - Its score stays close to the best score here (7.4 vs 7.6), while responding about 3.0x faster than DeepSeek V4 Pro.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-17

মেট্রিক DeepSeek V4 Pro DeepSeek V4 Pro high প্রকাশ: 2026-04-24 MiMo-V2.5-Pro MiMo-V2.5-Pro medium প্রকাশ: 2026-04-22
স্কোর 7.6 7.4
র‍্যাঙ্ক #41 #51
নির্ভরযোগ্যতা 9.3 10.0
ধারাবাহিকতা 7.0 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 66.7% 68.3%
অস্থির টেস্ট 8 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 1.742 2.541
মোট খরচ $0.157 $0.106
ইনপুট মূল্য $0.435 / 1M $0.435 / 1M
আউটপুট মূল্য $0.870 / 1M $0.870 / 1M
মোট ইনপুট টোকেন 38,726 40,854
আউটপুট টোকেন 6,334 5,015
রিজনিং টোকেন 159,151 97,742
প্রতিক্রিয়া সময় (গড়) 77.20s 26.13s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 416.76s 130.77s
প্রতিক্রিয়া সময় (মোট) 1621.17s 548.65s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#41 DeepSeek V4 Pro

high
Cost
$0.023
Time
257.6s
Tokens
14,870 tok

#51 MiMo-V2.5-Pro

medium
Invalid SVG
Cost
$0.000
Time
300.0s
Tokens
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V4 Pro 5.7 5.9 58.3% 2 25.70s 536 149 3,214
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 3.26s 621 323 1,179
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V4 Pro 6.1 4.6 66.7% 2 243.00s 5,090 383 84,580
MiMo-V2.5-Pro 6.2 4.7 66.7% 2 92.07s 6,543 780 51,218
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V4 Pro 10.0 10.0 100.0% 0 38.17s 14,060 454 5,836
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 53.36s 15,060 348 11,870
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V4 Pro 10.0 10.0 100.0% 0 25.03s 7,690 274 2,166
MiMo-V2.5-Pro 7.3 5.8 83.3% 1 18.81s 7,746 260 8,383
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V4 Pro 3.6 7.2 22.2% 1 151.46s 569 4,404 50,391
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 37.87s 630 275 17,023
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V4 Pro 10.0 10.0 100.0% 0 8.83s 471 115 1,013
MiMo-V2.5-Pro 5.5 10.0 0.0% 0 4.02s 492 155 163
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V4 Pro 7.8 6.6 83.3% 1 8.73s 627 66 2,726
MiMo-V2.5-Pro 9.9 10.0 100.0% 0 2.77s 672 82 803
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V4 Pro 6.9 4.9 77.8% 2 56.85s 591 178 2,563
MiMo-V2.5-Pro 6.7 7.9 55.6% 1 5.31s 660 540 2,181
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V4 Pro 9.8 10.0 100.0% 0 15.92s 8,909 295 701
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 16.87s 8,220 311 2,908
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
DeepSeek V4 Pro 3.0 10.0 0.0% 0 34.01s 183 16 5,961
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 12.46s 210 1,941 2,014

দ্রুত তুলনা

তুলনার জুটি বদলান