सारांश
Decider V1.1 27B AI BENCHY वर 2.6 स्कोर करते आणि #395 वर आहे. याची reliability 10.0, pass rate 17.4%, एकूण खर्च $0.002, आणि सरासरी response time 320ms आहे.
Decider V1.1 27B खास का आहे: समान मॉडेल्सच्या तुलनेत हे लक्षणीय वेगवान आहे.
मॉडेलची माहिती
संशोधन दिनांक: 2026-10-07
- पॅरामीटर्स
- 27B
- आर्किटेक्चर
- घन
- उपलब्धता
- मुक्त स्रोत
- परवाना
- Apache-2.0
2.6
सुसंगतता
5.2
10.0
$0.002
एकूण आउटपुट टोकन्स
69
एकूण इनपुट टोकन्स
73,557
इनपुट किंमत
$0.020 / 1M
आउटपुट किंमत
$0.000 / 1M
कॅश वाचण्याची किंमत
लागू नाही
कॅश लिहिण्याची किंमत
लागू नाही
कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.
चुकीच्या चाचण्या: 8
प्रति प्रयत्न पास दर: 17.4%
बेंचमार्क कव्हरेज: 36/69 प्रयत्न. अडॅप्टर पर्याय देतात. 12/23 चाचण्या समर्थित आहेत. इतर चाचण्या असमर्थित आहेत, अयशस्वी नाहीत. गुण संपूर्ण चाचणी संचावर आधारित आहेत.
अस्थिर चाचण्या
0
अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).
चार्ट्स
पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.
स्कोअर vs एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
झटपट तुलना
श्रेणीवार तपशील
| श्रेणी | स्कोअर | सुसंगतता | बरोबर चाचण्या |
|---|---|---|---|
| स्वायत्त एजंट कार्ये | 0.0 | 0.0 | |
| अँटी-एआय युक्त्या | 4.0 | 7.5 | |
| कोडिंग | 4.9 | 6.7 | |
| संयुक्त | 0.0 | 0.0 | |
| डेटा पार्सिंग आणि निष्कर्षण | 6.5 | 10.0 | |
| डोमेन-विशिष्ट | 5.3 | 10.0 | |
| Samanya Buddhimatta | 0.0 | 0.0 | |
| सूचनांचे पालन | 1.5 | 5.0 | |
| कोडी सोडवणे | 1.7 | 3.3 | |
| टूल कॉलिंग | 0.0 | 0.0 | |
| सामान्य ज्ञान | 0.0 | 0.0 |