Advertise here
#234

Apodex 1.1 Mini

Apodex रिलीज़: 2026-10-02 परीक्षण किया गया: 2026-10-02 10:21 apodex/apodex-1.1-mini::low
35B कुल (~3B सक्रिय)MoEमुक्त स्रोतअनुमानित

सारांश

Apodex 1.1 Mini AI BENCHY पर 6.1 स्कोर करता है और #234 पर है। इसकी reliability 10.0, pass rate 63.8%, कुल लागत $0.000, और औसत response time 33.68s है।

Apodex 1.1 Mini को अलग क्या बनाता है: यह डेटा पार्सिंग और निष्कर्षण में सबसे अलग दिखता है, जहाँ इसकी रैंक #1 है; जबकि डोमेन-विशिष्ट इसकी सबसे कमजोर जगह है, जहाँ यह #13 पर है। इस score range के लिए इसकी कुल benchmark लागत असामान्य रूप से कम है। यह असामान्य रूप से अधिक reasoning tokens इस्तेमाल करता है, जिससे धीमे या महंगे runs समझ में आ सकते हैं।

मॉडल विवरण

शोध की तारीख: 2026-10-02

अनुमानित
पैरामीटर
35B कुल (~3B सक्रिय)
आर्किटेक्चर
MoE
उपलब्धता
मुक्त स्रोत
लाइसेंस
Apache-2.0

सार्वजनिक साक्ष्यों पर आधारित सर्वोत्तम अनुमान; प्रदाता ने सभी मान जारी नहीं किए हैं।

संगति

7.9

कुल आउटपुट टोकन

508,815

कुल इनपुट टोकन

321,894

इनपुट कीमत

$0.000 / 1M

आउटपुट कीमत

$0.000 / 1M

कैश पढ़ने की कीमत

लागू नहीं

कैश लिखने की कीमत

लागू नहीं

कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।

सही परीक्षण

गलत टेस्ट: 12

प्रति प्रयास पास दर: 63.8%

अस्थिर टेस्ट

6

अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।

प्रतिक्रिया समय (औसत)

33.68s

प्रतिक्रिया समय (अधिकतम): 163.05s

प्रतिक्रिया समय (कुल): 774.73s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#234 Apodex 1.1 Mini

low
लागत
$0.000
समय
41.0s
टोकन
9,010 tok

चार्ट

पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

त्वरित तुलना

श्रेणी विवरण

श्रेणी स्कोर संगति सही परीक्षण
स्वायत्त एजेंट कार्य 5.0 10.0
एंटी-एआई ट्रिक्स 8.7 7.9
कोडिंग 5.1 4.9
संयुक्त 2.9 5.8
डेटा पार्सिंग और निष्कर्षण 10.0 10.0
डोमेन-विशिष्ट 3.6 7.2
Samanya Buddhimatta 4.7 1.6
निर्देश पालन 9.8 10.0
पहेली समाधान 10.0 10.0
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना किए गए मॉडल