AI BENCHY
Advertise here
#108

Hunter Alpha

OpenRouter रिलीज़: 2026-03-11 परीक्षण किया गया: 2026-05-06 14:09 openrouter/hunter-alpha::none
(medium) (none)

सारांश

Hunter Alpha AI BENCHY पर 5.7 स्कोर करता है और #108 पर है। इसकी reliability लागू नहीं, pass rate 46.3%, कुल लागत $0.000, और औसत response time 4.58s है।

Hunter Alpha को अलग क्या बनाता है: यह Samanya Buddhimatta में सबसे अलग दिखता है, जहाँ इसकी रैंक #3 है; जबकि कोडिंग इसकी सबसे कमजोर जगह है, जहाँ यह #13 पर है। इस score range के लिए इसकी कुल benchmark लागत असामान्य रूप से कम है।

संग्रहीत मॉडल: इस मॉडल को अब अपडेट नहीं किया जाएगा और नए परीक्षणों में टेस्ट नहीं किया जाएगा।

पहचान नोट

Hunter Alpha, Xiaomi: MiMo-V2-Pro का स्टेल्थ संस्करण था।

संगति

8.2

विश्वसनीयता

लागू नहीं

कुल आउटपुट टोकन

2,278

कुल इनपुट टोकन

0

इनपुट कीमत

$0.000 / 1M

आउटपुट कीमत

$0.000 / 1M

सही परीक्षण

गलत टेस्ट: 12

प्रति प्रयास पास दर: 46.3%

अस्थिर टेस्ट

4

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

4.58s

प्रतिक्रिया समय (अधिकतम): 15.17s

प्रतिक्रिया समय (कुल): 77.92s

Generation showcase

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#108 Hunter Alpha

none
Hunter Alpha was a stealth model revealed on March 18th as an early testing version of MiMo-V2-Pro. Find it here: https://openrouter.ai/xiaomi/mimo-v2-pro
Cost
$0.000
Time
0.0s
Tokens
0 tok

रन इतिहास

परीक्षण किया गया स्कोर विश्वसनीयता सही परीक्षण कुल लागत तुलना करें
2026-05-06 14:09 दोबारा परीक्षण 5.7 लागू नहीं $0.000 तुलना करें
2026-05-06 14:09 दोबारा परीक्षण 5.7 लागू नहीं $0.000 तुलना करें
2026-05-06 14:09 दोबारा परीक्षण 5.7 लागू नहीं $0.000 तुलना करें
2026-05-06 14:09 सूट बदला गया 5.7 लागू नहीं $0.000 वर्तमान रन
2026-04-11 00:35 पहला दर्ज रन 5.7 लागू नहीं $0.000 तुलना करें

इस रन में अलग बेंचमार्क सूट इस्तेमाल हुआ था। ऐतिहासिक बदलाव पढ़ते समय सूट बदलाव को ध्यान में रखें।

रन तुलना

रनस्कोरसंगतिविश्वसनीयतासही परीक्षणअस्थिर टेस्टकुल आउटपुट टोकनकुल इनपुट टोकनकुल लागतप्रतिक्रिया समय (औसत)
2026-05-06 14:09 · सूट बदला गया5.78.2लागू नहीं6/1842,2780$0.0004.58s
2026-05-06 14:09 · दोबारा परीक्षण5.78.2लागू नहीं6/1842,2780$0.0004.58s
अंतर0.00.00000$0.0000ms

चार्ट

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

त्वरित तुलना

श्रेणी विवरण

श्रेणी स्कोर संगति सही परीक्षण
एंटी-एआई ट्रिक्स 3.5 8.0
कोडिंग 3.0 10.0
संयुक्त 3.0 10.0
डेटा पार्सिंग और निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 5.3 10.0
Samanya Buddhimatta 6.1 3.1
निर्देश पालन 6.4 10.0
पहेली समाधान 5.8 4.4
टूल कॉलिंग 10.0 10.0

तुलना किए गए मॉडल