सारांश
Kev 4B AI BENCHY पर 3.0 स्कोर करता है और #366 पर है। इसकी reliability 10.0, pass rate 16.7%, कुल लागत $0.002, और औसत response time 5.63s है।
Kev 4B को अलग क्या बनाता है: इस score range के लिए इसकी कुल benchmark लागत असामान्य रूप से कम है। यह समान मॉडलों की तुलना में काफ़ी तेज है।
मॉडल विवरण
शोध की तारीख: 2026-09-28
- पैरामीटर
- 4B
- आर्किटेक्चर
- सघन
- उपलब्धता
- मुक्त स्रोत
- लाइसेंस
- Apache-2.0
सार्वजनिक साक्ष्यों पर आधारित सर्वोत्तम अनुमान; प्रदाता ने सभी मान जारी नहीं किए हैं।
3.0
संगति
5.1
10.0
$0.002
कुल आउटपुट टोकन
28,061
कुल इनपुट टोकन
42,804
इनपुट कीमत
$0.042 / 1M
आउटपुट कीमत
$0.000 / 1M
गलत टेस्ट: 9
प्रति प्रयास पास दर: 16.7%
बेंचमार्क कवरेज: 36/66 प्रयास. विकल्प अडैप्टर देते हैं। 12/22 परीक्षण समर्थित हैं। अन्य परीक्षण असमर्थित हैं, विफल नहीं। स्कोर पूरे परीक्षण समूह पर आधारित है।
अस्थिर टेस्ट
1
अस्थिर टेस्ट में रनों के बीच मिले-जुले परिणाम रहे (कम से कम एक पास और एक फेल)।
चार्ट
पहले मॉडल चुनें, फिर दूसरा मॉडल क्लिक करके साइड-बाय-साइड पेज खोलें।
स्कोर vs कुल लागत
प्रतिक्रिया समय (औसत)
स्कोर vs प्रतिक्रिया समय (औसत)
कुल आउटपुट टोकन
स्कोर vs कुल आउटपुट टोकन
त्वरित तुलना
श्रेणी विवरण
| श्रेणी | स्कोर | संगति | सही परीक्षण |
|---|---|---|---|
| एंटी-एआई ट्रिक्स | 2.3 | 7.5 | |
| कोडिंग | 4.5 | 6.7 | |
| संयुक्त | 0.0 | 0.0 | |
| डेटा पार्सिंग और निष्कर्षण | 6.5 | 10.0 | |
| डोमेन-विशिष्ट | 5.3 | 10.0 | |
| Samanya Buddhimatta | 0.0 | 0.0 | |
| निर्देश पालन | 1.5 | 5.0 | |
| पहेली समाधान | 2.0 | 10.0 | |
| टूल कॉलिंग | 0.0 | 0.0 | |
| सामान्य ज्ञान | 0.0 | 0.0 |