নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Qwen: Qwen3.5 Plus 2026-02-15 vs Xiaomi: MiMo-V2.5

সারাংশ

Qwen3.5 Plus 2026-02-15 vs MiMo-V2.5 benchmark তুলনা: Qwen3.5 Plus 2026-02-15 average score-এ এগিয়ে: 5.8 vs 5.1. MiMo-V2.5-এর benchmark খরচ কম: $0.007 vs $0.016. MiMo-V2.5 দ্রুত: 2.20s vs 2.31s, pass rates 46.0% vs 27.0%.

প্রস্তাবিত মডেল: MiMo-V2.5 - Its score stays close to the best score here (5.1 vs 5.8), while costing about 2.4x less than Qwen3.5 Plus 2026-02-15.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-06-18

মেট্রিক Qwen3.5 Plus 2026-02-15 Qwen3.5 Plus 2026-02-15 none প্রকাশ: 2026-02-15 MiMo-V2.5 MiMo-V2.5 none প্রকাশ: 2026-04-22
স্কোর 5.8 5.1
র‍্যাঙ্ক #106 #134
নির্ভরযোগ্যতা 10.0 10.0
ধারাবাহিকতা 9.4 9.6
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 46.0% 27.0%
অস্থির টেস্ট 2 1
মোট রান 63 63
প্রতি ফলাফলে খরচ 0.204 0.413
মোট খরচ $0.016 $0.007
ইনপুট মূল্য $0.260 / 1M $0.140 / 1M
আউটপুট মূল্য $1.560 / 1M $0.280 / 1M
মোট ইনপুট টোকেন 45,864 41,985
আউটপুট টোকেন 2,480 2,267
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 2.31s 2.20s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 6.65s 6.86s
প্রতিক্রিয়া সময় (মোট) 34.63s 46.21s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#106 Qwen3.5 Plus 2026-02-15

none
খরচ
$0.012
সময়
153.2s
টোকেন
7,787 tok

#134 MiMo-V2.5

none
খরচ
$0.007
সময়
267.4s
টোকেন
25,283 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5 Plus 2026-02-15 4.8 10.0 25.0% 0 1.91s 696 517 0
MiMo-V2.5 3.5 8.0 16.7% 1 2.19s 645 282 0
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5 Plus 2026-02-15 4.3 7.9 11.1% 1 2.05s 7,913 473 0
MiMo-V2.5 5.5 10.0 33.3% 0 3.24s 7,440 696 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 6.65s 18,304 314 0
MiMo-V2.5 3.0 10.0 0.0% 0 2.36s 15,075 330 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 1.89s 7,794 243 0
MiMo-V2.5 6.5 10.0 50.0% 0 1.01s 7,758 366 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5 Plus 2026-02-15 5.3 10.0 33.3% 0 1.17s 789 17 0
MiMo-V2.5 3.0 10.0 0.0% 0 756ms 753 27 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5 Plus 2026-02-15 4.4 3.0 33.3% 1 2.26s 522 117 0
MiMo-V2.5 4.4 9.9 0.0% 0 6.86s 498 81 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 1.67s 711 72 0
MiMo-V2.5 6.5 10.0 50.0% 0 751ms 684 72 0
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5 Plus 2026-02-15 7.7 10.0 66.7% 0 2.71s 714 494 0
MiMo-V2.5 5.4 10.0 33.3% 0 2.13s 678 166 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5 Plus 2026-02-15 10.0 10.0 100.0% 0 3.33s 8,211 222 0
MiMo-V2.5 10.0 10.0 100.0% 0 2.43s 8,238 231 0
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
Qwen3.5 Plus 2026-02-15 3.0 10.0 0.0% 0 1.11s 210 11 0
MiMo-V2.5 3.0 10.0 0.0% 0 3.89s 216 16 0

দ্রুত তুলনা

তুলনার জুটি বদলান