AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#75

Hunter Alpha

OpenRouter रिलीज़: 2026-03-11 परीक्षण किया गया: 2026-05-06 14:09 openrouter/hunter-alpha::medium
~1T कुल (~42B सक्रिय)MoEबंद स्रोतअनुमानित
(medium) (none)

सारांश

Hunter Alpha AI BENCHY पर 6.7 स्कोर करता है और #75 पर है। इसकी reliability लागू नहीं, pass rate 64.8%, कुल लागत $0.000, और औसत response time 10.33s है।

Hunter Alpha को अलग क्या बनाता है: इस score range के लिए इसकी कुल benchmark लागत असामान्य रूप से कम है।

संग्रहीत मॉडल: इस मॉडल को अब अपडेट नहीं किया जाएगा और नए परीक्षणों में टेस्ट नहीं किया जाएगा।

पहचान नोट

Hunter Alpha, Xiaomi: MiMo-V2-Pro का स्टेल्थ संस्करण था।

मॉडल विवरण

शोध की तारीख: 2026-08-12

अनुमानित
पैरामीटर
~1T कुल (~42B सक्रिय)
आर्किटेक्चर
MoE
उपलब्धता
बंद स्रोत
लाइसेंस
-

सार्वजनिक साक्ष्यों पर आधारित सर्वोत्तम अनुमान; प्रदाता ने सभी मान जारी नहीं किए हैं।

संगति

7.4

विश्वसनीयता

लागू नहीं

कुल आउटपुट टोकन

22,645

कुल इनपुट टोकन

0

इनपुट कीमत

$0.000 / 1M

आउटपुट कीमत

$0.000 / 1M

सही परीक्षण

गलत टेस्ट: 10

प्रति प्रयास पास दर: 64.8%

अस्थिर टेस्ट

6

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

10.33s

प्रतिक्रिया समय (अधिकतम): 30.53s

प्रतिक्रिया समय (कुल): 175.60s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#75 Hunter Alpha

medium
Hunter Alpha was a stealth model revealed on March 18th as an early testing version of MiMo-V2-Pro. Find it here: https://openrouter.ai/xiaomi/mimo-v2-pro
लागत
$0.000
समय
0.0s
टोकन
0 tok

रन इतिहास

परीक्षण किया गया स्कोर विश्वसनीयता सही परीक्षण कुल लागत तुलना करें
2026-05-06 14:09 दोबारा परीक्षण 4.7 लागू नहीं $0.000 तुलना करें
2026-05-06 14:09 दोबारा परीक्षण 4.7 लागू नहीं $0.000 तुलना करें
2026-05-06 14:09 दोबारा परीक्षण 6.7 लागू नहीं $0.000 तुलना करें
2026-05-06 14:09 दोबारा परीक्षण 6.7 लागू नहीं $0.000 तुलना करें
2026-05-06 14:09 दोबारा परीक्षण 6.7 लागू नहीं $0.000 तुलना करें
2026-05-06 14:09 सूट बदला गया 6.7 लागू नहीं $0.000 वर्तमान रन
2026-04-11 00:35 पहला दर्ज रन 6.7 लागू नहीं $0.000 तुलना करें

इस रन में अलग बेंचमार्क सूट इस्तेमाल हुआ था। ऐतिहासिक बदलाव पढ़ते समय सूट बदलाव को ध्यान में रखें।

रन तुलना

रनबेंचमार्क कवरेजस्कोरसंगतिविश्वसनीयतासही परीक्षणअस्थिर टेस्टकुल आउटपुट टोकनकुल इनपुट टोकनकुल लागतप्रतिक्रिया समय (औसत)
2026-05-06 14:09 · सूट बदला गया52/54 प्रयास6.77.4लागू नहीं8/18622,6450$0.00010.33s
2026-05-06 14:09 · दोबारा परीक्षण52/54 प्रयास6.77.4लागू नहीं8/18622,6450$0.00010.33s
अंतर0.00.00000$0.0000ms

चार्ट

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

श्रेणी स्कोर संगति सही परीक्षण
एंटी-एआई ट्रिक्स 7.3 5.8
कोडिंग 3.0 10.0
संयुक्त 4.7 1.6
डेटा पार्सिंग और निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 3.0 10.0
Samanya Buddhimatta 7.0 3.7
निर्देश पालन 9.9 10.0
पहेली समाधान 6.1 4.7
टूल कॉलिंग 10.0 10.0

तुलना किए गए मॉडल