নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

Mistral: Mistral Small 4 vs xAI: Grok 4.20 Beta

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-03-17

মেট্রিক Mistral Small 4 Mistral Small 4 none প্রকাশ: 2026-03-16 Grok 4.20 Beta Grok 4.20 Beta none প্রকাশ: 2026-03-12
র‍্যাঙ্ক #61 #58
স্কোর 5.3 5.3
ধারাবাহিকতা 9.5 9.1
প্রতি ফলাফলে খরচ 0.108 2.240
মোট খরচ $0.006 $0.090
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 33.3% 31.4%
অস্থির টেস্ট 1 2
মোট রান 51 51
আউটপুট টোকেন 1,624 1,517
রিজনিং টোকেন 0 0
প্রতিক্রিয়া সময় (গড়) 629ms 1.19s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 1.72s 6.48s
প্রতিক্রিয়া সময় (মোট) 10.70s 20.22s

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 3.4 7.9 16.7% 1 395ms 182 0
Grok 4.20 Beta 4.0 8.4 16.7% 1 597ms 251 0
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 3.0 10.0 0.0% 0 1.72s 496 0
Grok 4.20 Beta 3.0 10.0 0.0% 0 6.48s 282 0
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 10.0 10.0 100.0% 0 822ms 261 0
Grok 4.20 Beta 10.0 10.0 100.0% 0 601ms 197 0
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 5.3 10.0 33.3% 0 367ms 28 0
Grok 4.20 Beta 3.0 10.0 0.0% 0 611ms 160 0
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 4.0 10.0 0.0% 0 729ms 205 0
Grok 4.20 Beta 5.0 10.0 0.0% 0 541ms 87 0
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 6.5 10.0 50.0% 0 380ms 69 0
Grok 4.20 Beta 4.8 10.0 0.0% 0 687ms 60 0
Puzzle Solving স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 3.1 9.9 0.0% 0 589ms 170 0
Grok 4.20 Beta 5.9 7.2 55.6% 1 541ms 291 0
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) আউটপুট টোকেন রিজনিং টোকেন
Mistral Small 4 10.0 10.0 100.0% 0 1.40s 213 0
Grok 4.20 Beta 10.0 10.0 100.0% 0 4.79s 189 0

দ্রুত তুলনা

তুলনার জুটি বদলান