AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com
#135

Granite 4.1 8B

IBM Granite प्रकाशन: 2026-05-01 चाचणी तारीख: 2026-05-01 00:31 ibm-granite/granite-4.1-8b::none
8Bघनमुक्त स्रोत

सारांश

Granite 4.1 8B AI BENCHY वर 4.3 स्कोर करते आणि #135 वर आहे. याची reliability 10.0, pass rate 11.1%, एकूण खर्च $0.003, आणि सरासरी response time 767ms आहे.

Granite 4.1 8B खास का आहे: या score range साठी एकूण benchmark खर्च असामान्यपणे कमी आहे. समान मॉडेल्सच्या तुलनेत हे लक्षणीय वेगवान आहे.

मॉडेलची माहिती

संशोधन दिनांक: 2026-08-12

जाहीर केलेले
पॅरामीटर्स
8B
आर्किटेक्चर
घन
उपलब्धता
मुक्त स्रोत
परवाना
Apache-2.0

सुसंगतता

10.0

एकूण आउटपुट टोकन्स

2,712

एकूण इनपुट टोकन्स

0

इनपुट किंमत

$0.050 / 1M

आउटपुट किंमत

$0.100 / 1M

बरोबर चाचण्या

चुकीच्या चाचण्या: 16

प्रति प्रयत्न पास दर: 11.1%

अस्थिर चाचण्या

0

अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).

प्रतिसाद वेळ (सरासरी)

767ms

प्रतिसाद वेळ (कमाल): 2.17s

प्रतिसाद वेळ (एकूण): 13.81s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#135 IBM: Granite 4.1 8B

none
खर्च
$0.001
वेळ
3.2s
टोकन्स
491 tok

रन इतिहास

चाचणी तारीख स्कोअर विश्वसनीयता बरोबर चाचण्या एकूण खर्च तुलना करा
2026-08-14 02:51 पुन्हा चाचणी 4.0 10.0 $0.007 तुलना करा
2026-07-16 23:04 नवीन चाचणी जोडली 4.0 10.0 $0.007 तुलना करा
2026-06-04 14:07 नवीन चाचणी जोडली 4.0 10.0 $0.003 तुलना करा
2026-05-22 00:30 सूट बदलला 4.1 10.0 $0.003 तुलना करा
2026-05-01 00:31 पहिला रन 4.3 10.0 $0.003 सध्याची रन

रन तुलना

रनबेंचमार्क कव्हरेजस्कोअरसुसंगतताविश्वसनीयताबरोबर चाचण्याअस्थिर चाचण्याएकूण आउटपुट टोकन्सएकूण इनपुट टोकन्सएकूण खर्चप्रतिसाद वेळ (सरासरी)
2026-05-01 00:31 · पहिला रन54/54 प्रयत्न4.310.010.02/1802,7120$0.003767ms
2026-06-04 14:07 · नवीन चाचणी जोडली63/63 प्रयत्न4.010.010.02/2102,91146,285$0.003728ms
फरक+0.20.00.000-199-46285-$0.001+39ms

बेंचमार्क कव्हरेज वेगळे आहे: 54/54 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती) विरुद्ध 63/63 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती). एकूण मूल्ये आणि पुनरावृत्तीवर अवलंबून मेट्रिक्स थेट तुलना करता येत नाहीत.

या दोन रनमध्ये वेगवेगळे बेंचमार्क सूट वापरले गेले, त्यामुळे फरकांमध्ये मॉडेलमधील आणि सूटमधील दोन्ही बदल दिसतात.

चार्ट्स

पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

झटपट तुलना

श्रेणीवार तपशील

श्रेणी स्कोअर सुसंगतता बरोबर चाचण्या
अँटी-एआय युक्त्या 4.9 10.0
कोडिंग 6.9 10.0
संयुक्त 3.0 10.0
डेटा पार्सिंग आणि निष्कर्षण 3.0 10.0
डोमेन-विशिष्ट 3.0 10.0
Samanya Buddhimatta 4.0 10.0
सूचनांचे पालन 3.6 9.9
कोडी सोडवणे 3.7 10.0
टूल कॉलिंग 10.0 10.0

तुलना केलेली मॉडेल्स