নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5-Flash vs Xiaomi: MiMo-V2.5-Pro

সারাংশ

Qwen3.5-Flash vs MiMo-V2.5-Pro benchmark তুলনা: MiMo-V2.5-Pro average score-এ এগিয়ে: 7.4 vs 6.8. Qwen3.5-Flash-এর benchmark খরচ কম: $0.080 vs $0.106. MiMo-V2.5-Pro দ্রুত: 26.13s vs 63.29s, pass rates 71.4% vs 68.3%.

প্রস্তাবিত মডেল: MiMo-V2.5-Pro - It has the best score here (7.4), while responding about 2.4x faster than Qwen3.5-Flash.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-18

মেট্রিক Qwen3.5-Flash Qwen3.5-Flash medium প্রকাশ: 2026-02-24 MiMo-V2.5-Pro MiMo-V2.5-Pro medium প্রকাশ: 2026-04-22
স্কোর 6.8 7.4
র‍্যাঙ্ক #70 #51
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 8.1 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 71.4% 68.3%
অস্থির টেস্ট 5 4
মোট রান 63 63
প্রতি ফলাফলে খরচ 0.871 2.541
মোট খরচ $0.080 $0.106
ইনপুট মূল্য $0.065 / 1M $0.435 / 1M
আউটপুট মূল্য $0.260 / 1M $0.870 / 1M
মোট ইনপুট টোকেন 38,926 40,854
আউটপুট টোকেন 2,088 5,015
রিজনিং টোকেন 294,598 97,742
প্রতিক্রিয়া সময় (গড়) 63.29s 26.13s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 234.29s 130.77s
প্রতিক্রিয়া সময় (মোট) 1265.85s 548.65s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#70 Qwen3.5-Flash

medium
খরচ
$0.002
সময়
25.8s
টোকেন
4,294 tok

#51 MiMo-V2.5-Pro

medium
অবৈধ SVG
খরচ
$0.000
সময়
300.0s
টোকেন
0 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 10.0 10.0 100.0% 0 59.11s 672 383 32,992
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 3.26s 621 323 1,179
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 3.7 7.2 22.2% 1 58.87s 6,685 302 90,081
MiMo-V2.5-Pro 6.2 4.7 66.7% 2 92.07s 6,543 780 51,218
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 10.0 10.0 100.0% 0 17.78s 14,934 483 8,270
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 53.36s 15,060 348 11,870
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 7.3 5.9 83.3% 1 56.99s 6,061 235 16,237
MiMo-V2.5-Pro 7.3 5.8 83.3% 1 18.81s 7,746 260 8,383
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 5.3 7.2 44.4% 1 146.50s 581 58 43,615
MiMo-V2.5-Pro 5.3 10.0 33.3% 0 37.87s 630 275 17,023
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 6.1 3.1 66.7% 1 40.05s 516 99 38,486
MiMo-V2.5-Pro 5.5 10.0 0.0% 0 4.02s 492 155 163
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 10.0 10.0 100.0% 0 63.49s 699 98 14,139
MiMo-V2.5-Pro 9.9 10.0 100.0% 0 2.77s 672 82 803
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 8.2 7.2 88.9% 1 27.61s 381 89 12,457
MiMo-V2.5-Pro 6.7 7.9 55.6% 1 5.31s 660 540 2,181
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 10.0 10.0 100.0% 0 10.33s 8,193 309 1,284
MiMo-V2.5-Pro 10.0 10.0 100.0% 0 16.87s 8,220 311 2,908
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5-Flash 3.0 10.0 0.0% 0 48.98s 204 32 37,037
MiMo-V2.5-Pro 3.0 10.0 0.0% 0 12.46s 210 1,941 2,014

দ্রুত তুলনা

তুলনার জুটি বদলান