নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

xAI: Grok 4.20 Beta vs Xiaomi: MiMo-V2-Pro

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-03-20

মেট্রিক Grok 4.20 Beta Grok 4.20 Beta medium প্রকাশ: 2026-03-12 MiMo-V2-Pro MiMo-V2-Pro medium প্রকাশ: 2026-03-18
স্কোর 7.9 8.0
র‍্যাঙ্ক #22 #20
ধারাবাহিকতা 9.0 8.5
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 72.6% 76.5%
অস্থির টেস্ট 2 3
মোট রান 51 45
প্রতি ফলাফলে খরচ 5.525 1.110
মোট খরচ $0.608 $0.123
???? ??? $2.000 / 1M $1.000 / 1M
????? ??? $6.000 / 1M $3.000 / 1M
আউটপুট টোকেন 1,487 1,875
রিজনিং টোকেন 87,922 26,959
প্রতিক্রিয়া সময় (গড়) 8.54s 9.78s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 24.21s 64.71s
প্রতিক্রিয়া সময় (মোট) 145.26s 156.45s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 Beta 8.7 7.9 91.7% 1 3.16s 268 7,583
MiMo-V2-Pro 10.0 10.0 100.0% 0 3.06s 223 1,107
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 Beta 10.0 10.0 100.0% 0 20.93s 227 12,212
MiMo-V2-Pro 4.7 1.6 66.7% 1 64.71s 380 14,186
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.01s 180 5,281
MiMo-V2-Pro 7.3 5.8 83.3% 1 17.20s 260 7,484
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 Beta 5.3 10.0 33.3% 0 21.33s 251 40,255
MiMo-V2-Pro 5.3 10.0 33.3% 0 6.00s 155 1,048
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 Beta 10.0 10.0 100.0% 0 5.78s 72 3,440
MiMo-V2-Pro 10.0 10.0 100.0% 0 4.06s 198 424
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 Beta 8.3 10.0 50.0% 0 4.97s 57 7,107
MiMo-V2-Pro 9.9 10.0 100.0% 0 3.36s 83 667
Puzzle Solving স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 Beta 8.2 7.2 88.9% 1 3.85s 249 6,660
MiMo-V2-Pro 7.0 7.2 55.6% 1 4.71s 313 1,179
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Grok 4.20 Beta 3.0 10.0 0.0% 0 12.39s 183 5,384
MiMo-V2-Pro 10.0 10.0 100.0% 0 8.19s 263 864

দ্রুত তুলনা

তুলনার জুটি বদলান