নেভিগেশন
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

AI BENCHY Compare

MiniMax: MiniMax M3 vs xAI: Grok Build 0.1

সারাংশ

MiniMax M3 vs Grok Build 0.1 benchmark তুলনা: average score প্রায় সমান: 7.6 vs 7.6. MiniMax M3-এর benchmark খরচ কম: $0.131 vs $0.927. Grok Build 0.1 দ্রুত: 49.90s vs 68.17s, pass rates 65.1% vs 61.9%.

প্রস্তাবিত মডেল: MiniMax M3 - It has the best score here (7.6), while costing about 7.1x less than Grok Build 0.1.

AI BENCHY টেস্ট স্যুট থেকে বেঞ্চমার্ক তৈরি হয়েছে: 2026-07-02

মেট্রিক MiniMax M3 MiniMax M3 medium প্রকাশ: 2026-06-01 Grok Build 0.1 Grok Build 0.1 medium প্রকাশ: 2026-05-21
স্কোর 7.6 7.6
র‍্যাঙ্ক #42 #44
নির্ভরযোগ্যতা 9.6 10.0
ধারাবাহিকতা 7.9 9.9
সঠিক টেস্ট
প্রতি চেষ্টায় পাস রেট 65.1% 61.9%
অস্থির টেস্ট 5 0
মোট রান 63 63
প্রতি ফলাফলে খরচ 1.187 7.124
মোট খরচ $0.131 $0.927
ইনপুট মূল্য $0.300 / 1M $1.000 / 1M
আউটপুট মূল্য $1.200 / 1M $2.000 / 1M
মোট ইনপুট টোকেন 46,546 44,418
আউটপুট টোকেন 49,036 2,782
রিজনিং টোকেন 92,543 438,018
প্রতিক্রিয়া সময় (গড়) 68.17s 49.90s
প্রতিক্রিয়া সময় (সর্বোচ্চ) 431.03s 252.69s
প্রতিক্রিয়া সময় (মোট) 1363.38s 1047.92s

জেনারেশন শোকেস

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#42 MiniMax M3

medium
খরচ
$0.012
সময়
154.4s
টোকেন
10,018 tok

#44 xAI: Grok Build 0.1

medium
খরচ
$0.028
সময়
81.3s
টোকেন
14,009 tok

স্কোর অনুযায়ী শীর্ষ মডেল

স্কোর বনাম মোট খরচ

প্রতিক্রিয়া সময় (গড়)

স্কোর vs প্রতিক্রিয়া সময় (গড়)

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

বিভাগভিত্তিক বিশ্লেষণ

অ্যান্টি-এআই কৌশল স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
MiniMax M3 5.5 3.7 66.7% 3 14.95s 2,526 874 3,414
Grok Build 0.1 8.3 10.0 75.0% 0 7.43s 2,010 220 12,162
কোডিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
MiniMax M3 6.1 6.5 55.6% 1 144.74s 5,804 6,223 32,667
Grok Build 0.1 5.7 9.7 33.3% 0 108.46s 8,304 1,138 161,452
সমন্বিত স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
MiniMax M3 10.0 10.0 100.0% 0 65.30s 14,760 1,306 6,253
Grok Build 0.1 10.0 10.0 100.0% 0 32.81s 12,909 231 16,917
ডেটা পার্সিং ও নিষ্কাশন স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
MiniMax M3 10.0 10.0 100.0% 0 14.92s 8,088 514 3,164
Grok Build 0.1 10.0 10.0 100.0% 0 10.72s 7,761 180 8,876
ডোমেইন-নির্দিষ্ট স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
MiniMax M3 5.5 9.3 33.3% 0 233.13s 869 16,254 19,070
Grok Build 0.1 5.3 10.0 33.3% 0 158.00s 1,764 492 175,294
Sadharon Buddhimotta স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
MiniMax M3 5.1 3.4 33.3% 1 33.25s 954 2,487 2,523
Grok Build 0.1 4.4 9.9 0.0% 0 18.41s 825 76 6,345
নির্দেশনা অনুসরণ স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
MiniMax M3 9.8 10.0 100.0% 0 6.14s 1,623 103 920
Grok Build 0.1 9.8 10.0 100.0% 0 12.36s 1,362 57 9,599
ধাঁধা সমাধান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
MiniMax M3 7.9 9.9 66.7% 0 49.91s 2,079 11,946 13,761
Grok Build 0.1 7.7 10.0 66.7% 0 18.26s 1,689 195 20,841
টুল কলিং স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
MiniMax M3 10.0 10.0 100.0% 0 11.91s 9,168 281 555
Grok Build 0.1 10.0 10.0 100.0% 0 13.12s 7,263 180 4,969
সাধারণ জ্ঞান স্কোর ধারাবাহিকতা প্রতি চেষ্টায় পাস রেট অস্থির টেস্ট সঠিক টেস্ট প্রতিক্রিয়া সময় (গড়) ইনপুট টোকেন আউটপুট টোকেন রিজনিং টোকেন
MiniMax M3 3.0 10.0 0.0% 0 100.80s 675 9,048 10,216
Grok Build 0.1 3.0 10.0 0.0% 0 53.51s 531 13 21,563

দ্রুত তুলনা

তুলনার জুটি বদলান