AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#55

Hunter Alpha

OpenRouter প্রকাশ: 2026-03-11 পরীক্ষিত হয়েছে: 2026-04-11 00:35 openrouter/hunter-alpha::medium
(medium) (none)

সারাংশ

Hunter Alpha AI BENCHY-তে 6.7 স্কোর করে এবং #55 স্থানে আছে। এর reliability প্রযোজ্য নয়, pass rate 64.8%, মোট খরচ $0.000, এবং গড় response time 10.33s.

Hunter Alpha কে আলাদা করে যা: এই score range-এর জন্য মোট benchmark খরচ অস্বাভাবিকভাবে কম।

আর্কাইভড মডেল: এই মডেল আর আপডেট করা হবে না এবং নতুন টেস্টে পরীক্ষা করা হবে না।

পরিচয় নোট

Hunter Alpha ছিল Xiaomi: MiMo-V2-Pro-এর স্টেলথ সংস্করণ।

ধারাবাহিকতা

7.4

নির্ভরযোগ্যতা

প্রযোজ্য নয়

মোট আউটপুট টোকেন

22,645

মোট ইনপুট টোকেন

0

ইনপুট মূল্য

$0.000 / 1M

আউটপুট মূল্য

$0.000 / 1M

সঠিক টেস্ট

ভুল টেস্ট: 10

প্রতি চেষ্টায় পাস রেট: 64.8%

অস্থির টেস্ট

6

অস্থির টেস্টে রানভেদে মিশ্র ফল হয়েছে (কমপক্ষে একটি পাস এবং একটি ফেল)।

প্রতিক্রিয়া সময় (গড়)

10.33s

প্রতিক্রিয়া সময় (সর্বোচ্চ): 30.53s

প্রতিক্রিয়া সময় (মোট): 175.60s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#55 Hunter Alpha

medium
Hunter Alpha was a stealth model revealed on March 18th as an early testing version of MiMo-V2-Pro. Find it here: https://openrouter.ai/xiaomi/mimo-v2-pro
Cost
$0.000
Time
0.0s
Tokens
0 tok

রান ইতিহাস

পরীক্ষিত হয়েছে স্কোর নির্ভরযোগ্যতা সঠিক টেস্ট মোট খরচ তুলনা করুন
2026-05-06 14:09 পুনরায় পরীক্ষা 6.7 প্রযোজ্য নয় $0.000 তুলনা করুন
2026-05-06 14:09 পুনরায় পরীক্ষা 6.7 প্রযোজ্য নয় $0.000 তুলনা করুন
2026-05-06 14:09 পুনরায় পরীক্ষা 6.7 প্রযোজ্য নয় $0.000 তুলনা করুন
2026-05-06 14:09 স্যুইট পরিবর্তিত হয়েছে 6.7 প্রযোজ্য নয় $0.000 তুলনা করুন
2026-04-11 00:35 প্রথম নথিভুক্ত রান 6.7 প্রযোজ্য নয় $0.000 বর্তমান রান

রান তুলনা

রানস্কোরধারাবাহিকতানির্ভরযোগ্যতাসঠিক টেস্টঅস্থির টেস্টমোট আউটপুট টোকেনমোট ইনপুট টোকেনমোট খরচপ্রতিক্রিয়া সময় (গড়)
2026-04-11 00:35 · প্রথম নথিভুক্ত রান6.77.4প্রযোজ্য নয়8/18622,6450$0.00010.33s
2026-05-06 14:09 · পুনরায় পরীক্ষা6.77.4প্রযোজ্য নয়8/18622,6450$0.00010.33s
পার্থক্য0.00.00000$0.0000ms

এই দুই রান ভিন্ন বেঞ্চমার্ক স্যুইট ব্যবহার করেছে, তাই পার্থক্যগুলোতে মডেল পরিবর্তন এবং স্যুইট পরিবর্তন দুটোই ধরা পড়ে।

চার্ট

প্রথম মডেলটি নির্বাচন করুন, তারপর দ্বিতীয় মডেলে ক্লিক করে পাশাপাশি তুলনা পৃষ্ঠা খুলুন।

মোট আউটপুট টোকেন

স্কোর vs মোট আউটপুট টোকেন

দ্রুত তুলনা

বিভাগভিত্তিক বিশ্লেষণ

বিভাগ স্কোর ধারাবাহিকতা সঠিক টেস্ট
অ্যান্টি-এআই কৌশল 7.3 5.8
কোডিং 3.0 10.0
সমন্বিত 4.7 1.6
ডেটা পার্সিং ও নিষ্কাশন 10.0 10.0
ডোমেইন-নির্দিষ্ট 3.0 10.0
Sadharon Buddhimotta 7.0 3.7
নির্দেশনা অনুসরণ 9.9 10.0
ধাঁধা সমাধান 6.1 4.7
টুল কলিং 10.0 10.0

তুলনা করা মডেল