सारांश
Decider V1.1 27B AI BENCHY पर 2.6 स्कोर करता है और #395 पर है। इसकी reliability 10.0, pass rate 17.4%, कुल लागत $0.002, और औसत response time 320ms है।
Decider V1.1 27B को अलग क्या बनाता है: यह समान मॉडलों की तुलना में काफ़ी तेज है।
मॉडल विवरण
शोध की तारीख: 2026-10-07
- पैरामीटर
- 27B
- आर्किटेक्चर
- सघन
- उपलब्धता
- मुक्त स्रोत
- लाइसेंस
- Apache-2.0
2.6
संगति
5.2
10.0
$0.002
कुल आउटपुट टोकन
69
कुल इनपुट टोकन
73,557
इनपुट कीमत
$0.020 / 1M
आउटपुट कीमत
$0.000 / 1M
कैश पढ़ने की कीमत
लागू नहीं
कैश लिखने की कीमत
लागू नहीं
कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।
गलत टेस्ट: 8
प्रति प्रयास पास दर: 17.4%
बेंचमार्क कवरेज: 36/69 प्रयास. विकल्प अडैप्टर देते हैं। 12/23 परीक्षण समर्थित हैं। अन्य परीक्षण असमर्थित हैं, विफल नहीं। स्कोर पूरे परीक्षण समूह पर आधारित है।
अस्थिर टेस्ट
0
अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।
चार्ट
पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।
स्कोर vs कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
त्वरित तुलना
श्रेणी विवरण
| श्रेणी | स्कोर | संगति | सही परीक्षण |
|---|---|---|---|
| स्वायत्त एजेंट कार्य | 0.0 | 0.0 | |
| एंटी-एआई ट्रिक्स | 4.0 | 7.5 | |
| कोडिंग | 4.9 | 6.7 | |
| संयुक्त | 0.0 | 0.0 | |
| डेटा पार्सिंग और निष्कर्षण | 6.5 | 10.0 | |
| डोमेन-विशिष्ट | 5.3 | 10.0 | |
| Samanya Buddhimatta | 0.0 | 0.0 | |
| निर्देश पालन | 1.5 | 5.0 | |
| पहेली समाधान | 1.7 | 3.3 | |
| टूल कॉलिंग | 0.0 | 0.0 | |
| सामान्य ज्ञान | 0.0 | 0.0 |