AI BENCHY
Advertise here
#80

Hunter Alpha

OpenRouter रिलीज़: 2026-03-11 परीक्षण किया गया: 2026-05-06 14:09 openrouter/hunter-alpha::medium
(medium) (none)

सारांश

Hunter Alpha AI BENCHY पर 6.7 स्कोर करता है और #80 पर है। इसकी reliability लागू नहीं, pass rate 64.8%, कुल लागत $0.000, और औसत response time 10.33s है।

Hunter Alpha को अलग क्या बनाता है: यह Samanya Buddhimatta में सबसे अलग दिखता है, जहाँ इसकी रैंक #2 है; जबकि कोडिंग इसकी सबसे कमजोर जगह है, जहाँ यह #12 पर है। इस score range के लिए इसकी कुल benchmark लागत असामान्य रूप से कम है।

संग्रहीत मॉडल: इस मॉडल को अब अपडेट नहीं किया जाएगा और नए परीक्षणों में टेस्ट नहीं किया जाएगा।

पहचान नोट

Hunter Alpha, Xiaomi: MiMo-V2-Pro का स्टेल्थ संस्करण था।

संगति

7.4

विश्वसनीयता

लागू नहीं

कुल आउटपुट टोकन

22,651

कुल इनपुट टोकन

28,927

इनपुट कीमत

$0.000 / 1M

आउटपुट कीमत

$0.000 / 1M

सही परीक्षण

गलत टेस्ट: 10

प्रति प्रयास पास दर: 64.8%

अस्थिर टेस्ट

6

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

10.33s

प्रतिक्रिया समय (अधिकतम): 30.53s

प्रतिक्रिया समय (कुल): 175.58s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#80 Hunter Alpha

medium
Hunter Alpha was a stealth model revealed on March 18th as an early testing version of MiMo-V2-Pro. Find it here: https://openrouter.ai/xiaomi/mimo-v2-pro
Cost
$0.000
Time
0.0s
Tokens
0 tok

रन इतिहास

परीक्षण किया गया स्कोर विश्वसनीयता सही परीक्षण कुल लागत तुलना करें
2026-05-06 14:09 दोबारा परीक्षण 6.7 लागू नहीं $0.000 वर्तमान रन
2026-05-06 14:09 दोबारा परीक्षण 6.7 लागू नहीं $0.000 तुलना करें
2026-05-06 14:09 दोबारा परीक्षण 6.7 लागू नहीं $0.000 तुलना करें
2026-05-06 14:09 सूट बदला गया 6.7 लागू नहीं $0.000 तुलना करें
2026-04-11 00:35 पहला दर्ज रन 6.7 लागू नहीं $0.000 तुलना करें

रन तुलना

रनस्कोरसंगतिविश्वसनीयतासही परीक्षणअस्थिर टेस्टकुल आउटपुट टोकनकुल इनपुट टोकनकुल लागतप्रतिक्रिया समय (औसत)
2026-05-06 14:09 · वर्तमान रन6.77.4लागू नहीं8/18622,65128,927$0.00010.33s
2026-04-11 00:35 · पहला दर्ज रन6.77.4लागू नहीं8/18622,6450$0.00010.33s
अंतर0.00.000+6+28927$0.000-1ms

इन दो रन में अलग-अलग बेंचमार्क सूट इस्तेमाल हुए थे, इसलिए अंतर मॉडल बदलाव और सूट बदलाव दोनों को दर्शाते हैं।

कीमत का इतिहास

OpenRouter से इस मॉडल का ऐतिहासिक मूल्य डेटा।

तारीख इनपुट कीमत आउटपुट कीमत
2026-06-04 15:40 $0.000 / 1M $0.000 / 1M

चार्ट

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

त्वरित तुलना

श्रेणी विवरण

श्रेणी स्कोर संगति सही परीक्षण
एंटी-एआई ट्रिक्स 7.3 5.8
कोडिंग 3.0 10.0
संयुक्त 4.7 1.6
डेटा पार्सिंग और निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 3.0 10.0
Samanya Buddhimatta 7.0 3.7
निर्देश पालन 9.9 10.0
पहेली समाधान 6.1 4.7
टूल कॉलिंग 10.0 10.0

तुलना किए गए मॉडल