AI BENCHY
Advertise here
#65

MiniMax M3

Minimax প্রকাশ: 2026-06-01 পরীক্ষিত হয়েছে: 2026-06-01 10:53 minimax/minimax-m3::medium
428B মোট (23B সক্রিয়)MoEওজন উপলভ্য

সারাংশ

MiniMax M3 AI BENCHY-তে 7.3 স্কোর করে এবং #65 স্থানে আছে। এর reliability 9.6, pass rate 68.3%, মোট খরচ $0.120, এবং গড় response time 68.44s.

MiniMax M3 কে আলাদা করে যা: এটি সমন্বিত-তে সবচেয়ে ভালোভাবে নজর কাড়ে, যেখানে এর rank #1; আর অ্যান্টি-এআই কৌশল এর দুর্বলতম ক্ষেত্র, rank #18.

মডেলের তথ্য

গবেষণার তারিখ: 2026-08-12

প্রকাশিত
প্যারামিটার
428B মোট (23B সক্রিয়)
আর্কিটেকচার
MoE
উপলভ্যতা
ওজন উপলভ্য
লাইসেন্স
MiniMax Community

ধারাবাহিকতা

8.4

মোট আউটপুট টোকেন

132,819

মোট ইনপুট টোকেন

43,447

ইনপুট মূল্য

$0.300 / 1M

আউটপুট মূল্য

$1.200 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 9

প্রতি চেষ্টায় পাস রেট: 68.3%

অস্থির টেস্ট

6

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

68.44s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 431.03s

প্রতিক্রিয়া সময় (মোট): 1300.32s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#65 MiniMax M3

medium
খরচ
$0.012
সময়
154.4s
টোকেন
10,018 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-08-14 01:38 পুনরায় পরীক্ষা 7.5 9.7 $0.300 তুলনা করুন
2026-07-16 21:24 নতুন টেস্ট যোগ হয়েছে 7.6 9.7 $0.286 তুলনা করুন
2026-06-04 13:10 নতুন টেস্ট যোগ হয়েছে 7.1 9.6 $0.131 তুলনা করুন
2026-06-01 10:53 প্রথম রান 7.3 9.6 $0.120 বর্তমান রান

মূল্যের ইতিহাস

OpenRouter থেকে এই মডেলের ঐতিহাসিক মূল্য তথ্য।

তারিখ ইনপুট মূল্য আউটপুট মূল্য
2026-06-01 11:25 $0.300 / 1M $1.200 / 1M

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 5.5 3.7
কোডিং 7.5 10.0
সমন্বিত 10.0 10.0
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 6.0 10.0
Sadharon Buddhimotta 5.1 3.4
নির্দেশনা অনুসরণ 9.8 10.0
ধাঁধা সমাধান 7.9 9.9
টুল কলিং 10.0 10.0
সাধারণ জ্ঞান 3.0 10.0

তুলনা করা মডেল