নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-35B-A3B vs Xiaomi: MiMo-V2.5-Pro

সারাংশ

Qwen3.5-35B-A3B vs MiMo-V2.5-Pro benchmark তুলনা: Qwen3.5-35B-A3B average score-এ এগিয়ে: 6.3 vs 5.5. MiMo-V2.5-Pro-এর benchmark খরচ কম: $0.017 vs $0.401. MiMo-V2.5-Pro দ্রুত: 1.78s vs 72.57s, pass rates 69.8% vs 39.7%.

প্রস্তাবিত মডেল: MiMo-V2.5-Pro - Its score stays close to the best score here (5.5 vs 6.3), while costing about 25.0x less than Qwen3.5-35B-A3B.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-02

মেট্রিক Qwen3.5-35B-A3B Qwen3.5-35B-A3B medium প্রকাশ: 2026-02-24 MiMo-V2.5-Pro MiMo-V2.5-Pro none প্রকাশ: 2026-04-22
স্কোর 6.3 5.5
র‍্যাঙ্ক #92 #123
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 7.5 8.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 69.8% 39.7%
অস্থির টেস্ট 6 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 5.162 0.648
মোট খরচ $0.401 $0.017
ইনপুট মূল্য $0.140 / 1M $0.435 / 1M
আউটপুট মূল্য $1.000 / 1M $0.870 / 1M
মোট ইনপুট টোকেন 42,196 30,724
আউটপুট টোকেন 40,630 3,043
রিজনিং টোকেন 353,577 0
প্রতিক্রিয়া সময় (গড়) 72.57s 1.78s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 409.98s 8.32s
প্রতিক্রিয়া সময় (মোট) 1524.04s 37.42s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#92 Qwen3.5-35B-A3B

medium
খরচ
$0.009
সময়
71.4s
টোকেন
8,631 tok

#123 MiMo-V2.5-Pro

none
খরচ
$0.004
সময়
46.4s
টোকেন
4,025 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 21.13s 672 798 42,652
MiMo-V2.5-Pro 3.3 8.1 8.3% 1 2.67s 645 994 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-35B-A3B 5.9 9.3 33.3% 0 206.65s 4,106 23,844 111,462
MiMo-V2.5-Pro 4.3 7.8 22.2% 1 1.41s 6,559 485 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-35B-A3B 4.7 1.6 66.7% 1 75.34s 20,992 775 12,485
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 3.54s 4,695 596 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-35B-A3B 7.3 5.9 83.3% 1 59.33s 6,061 235 19,493
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 1.32s 7,758 249 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-35B-A3B 4.1 4.4 44.5% 2 88.34s 500 41 46,368
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 877ms 753 27 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-35B-A3B 2.8 1.6 33.3% 1 30.30s 172 20 3,753
MiMo-V2.5-Pro 4.0 10.0 0.0% 0 2.58s 498 87 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 24.45s 699 97 17,361
MiMo-V2.5-Pro 6.4 10.0 50.0% 0 1.03s 684 66 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-35B-A3B 8.2 7.2 88.9% 1 33.13s 597 3,592 26,585
MiMo-V2.5-Pro 6.7 4.7 77.8% 2 1.30s 678 267 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-35B-A3B 10.0 10.0 100.0% 0 4.65s 8,193 309 1,365
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 3.30s 8,238 258 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-35B-A3B 3.0 10.0 0.0% 0 177.35s 204 10,919 72,053
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 1.89s 216 14 0

দ্রুত তুলনা

তুলনার জুটি বদলান