सारांश
Tev1 4B Experimental AI BENCHY वर 1.0 स्कोर करते आणि #381 वर आहे. याची reliability 10.0, pass rate 13.0%, एकूण खर्च $0.002, आणि सरासरी response time 498ms आहे.
Tev1 4B Experimental खास का आहे: या score range साठी एकूण benchmark खर्च असामान्यपणे कमी आहे. समान मॉडेल्सच्या तुलनेत हे लक्षणीय वेगवान आहे.
मॉडेलची माहिती
संशोधन दिनांक: 2026-10-01
- पॅरामीटर्स
- 4B
- आर्किटेक्चर
- घन
- उपलब्धता
- वेट्स उपलब्ध
- परवाना
- Pending; see model card
सार्वजनिक पुराव्यावर आधारित सर्वोत्तम अंदाज; प्रदात्याने सर्व मूल्ये जाहीर केलेली नाहीत.
1.0
सुसंगतता
3.0
10.0
$0.002
एकूण आउटपुट टोकन्स
96
एकूण इनपुट टोकन्स
33,864
इनपुट किंमत
$0.042 / 1M
आउटपुट किंमत
$0.000 / 1M
कॅश वाचण्याची किंमत
लागू नाही
कॅश लिहिण्याची किंमत
लागू नाही
कॅशच्या किमती इनपुट टोकनला लागू होतात. वाचताना साठवलेले प्रॉम्प्ट पुन्हा वापरले जातात; लिहिताना ते साठवले जातात आणि अधिक खर्च होऊ शकतो. आउटपुट टोकनला आउटपुट किंमत लागू होते.
चुकीच्या चाचण्या: 4
प्रति प्रयत्न पास दर: 13.0%
बेंचमार्क कव्हरेज: 21/69 प्रयत्न. अडॅप्टर पर्याय देतात. 7/23 चाचण्या समर्थित आहेत. इतर चाचण्या असमर्थित आहेत, अयशस्वी नाहीत. गुण संपूर्ण चाचणी संचावर आधारित आहेत.
अस्थिर चाचण्या
0
अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).
चार्ट्स
पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.
स्कोअर vs एकूण खर्च
प्रतिसाद वेळ (सरासरी)
स्कोअर vs प्रतिसाद वेळ (सरासरी)
एकूण आउटपुट टोकन्स
स्कोअर vs एकूण आउटपुट टोकन्स
झटपट तुलना
श्रेणीवार तपशील
| श्रेणी | स्कोअर | सुसंगतता | बरोबर चाचण्या |
|---|---|---|---|
| स्वायत्त एजंट कार्ये | 0.0 | 0.0 | |
| अँटी-एआय युक्त्या | 2.5 | 2.5 | |
| कोडिंग | 0.0 | 0.0 | |
| संयुक्त | 0.0 | 0.0 | |
| डेटा पार्सिंग आणि निष्कर्षण | 3.0 | 10.0 | |
| डोमेन-विशिष्ट | 6.7 | 6.7 | |
| Samanya Buddhimatta | 0.0 | 0.0 | |
| सूचनांचे पालन | 1.5 | 5.0 | |
| कोडी सोडवणे | 1.7 | 3.3 | |
| टूल कॉलिंग | 0.0 | 0.0 | |
| सामान्य ज्ञान | 0.0 | 0.0 |