सारांश
Tev1 4B Experimental AI BENCHY पर 1.0 स्कोर करता है और #381 पर है। इसकी reliability 10.0, pass rate 13.0%, कुल लागत $0.002, और औसत response time 498ms है।
Tev1 4B Experimental को अलग क्या बनाता है: इस score range के लिए इसकी कुल benchmark लागत असामान्य रूप से कम है। यह समान मॉडलों की तुलना में काफ़ी तेज है।
मॉडल विवरण
शोध की तारीख: 2026-10-01
- पैरामीटर
- 4B
- आर्किटेक्चर
- सघन
- उपलब्धता
- वेट उपलब्ध
- लाइसेंस
- Pending; see model card
सार्वजनिक साक्ष्यों पर आधारित सर्वोत्तम अनुमान; प्रदाता ने सभी मान जारी नहीं किए हैं।
1.0
संगति
3.0
10.0
$0.002
कुल आउटपुट टोकन
96
कुल इनपुट टोकन
33,864
इनपुट कीमत
$0.042 / 1M
आउटपुट कीमत
$0.000 / 1M
कैश पढ़ने की कीमत
लागू नहीं
कैश लिखने की कीमत
लागू नहीं
कैश की कीमतें इनपुट टोकन पर लागू होती हैं। पढ़ने पर कैश किए गए प्रॉम्प्ट का दोबारा उपयोग होता है; लिखने पर वे सहेजे जाते हैं और अतिरिक्त लागत हो सकती है। आउटपुट टोकन पर आउटपुट की कीमत लागू होती है।
गलत टेस्ट: 4
प्रति प्रयास पास दर: 13.0%
बेंचमार्क कवरेज: 21/69 प्रयास. विकल्प अडैप्टर देते हैं। 7/23 परीक्षण समर्थित हैं। अन्य परीक्षण असमर्थित हैं, विफल नहीं। स्कोर पूरे परीक्षण समूह पर आधारित है।
अस्थिर टेस्ट
0
अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।
चार्ट
पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।
स्कोर vs कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
त्वरित तुलना
श्रेणी विवरण
| श्रेणी | स्कोर | संगति | सही परीक्षण |
|---|---|---|---|
| स्वायत्त एजेंट कार्य | 0.0 | 0.0 | |
| एंटी-एआई ट्रिक्स | 2.5 | 2.5 | |
| कोडिंग | 0.0 | 0.0 | |
| संयुक्त | 0.0 | 0.0 | |
| डेटा पार्सिंग और निष्कर्षण | 3.0 | 10.0 | |
| डोमेन-विशिष्ट | 6.7 | 6.7 | |
| Samanya Buddhimatta | 0.0 | 0.0 | |
| निर्देश पालन | 1.5 | 5.0 | |
| पहेली समाधान | 1.7 | 3.3 | |
| टूल कॉलिंग | 0.0 | 0.0 | |
| सामान्य ज्ञान | 0.0 | 0.0 |