Advertise here
#153

Granite 4.1 8B

IBM Granite प्रकाशन: 2026-05-01 चाचणी तारीख: 2026-05-22 00:30 ibm-granite/granite-4.1-8b::none
8Bघनमुक्त स्रोत

सारांश

Granite 4.1 8B AI BENCHY वर 4.1 स्कोर करते आणि #153 वर आहे. याची reliability 10.0, pass rate 10.0%, एकूण खर्च $0.003, आणि सरासरी response time 723ms आहे.

Granite 4.1 8B खास का आहे: या score range साठी एकूण benchmark खर्च असामान्यपणे कमी आहे. समान मॉडेल्सच्या तुलनेत हे लक्षणीय वेगवान आहे.

मॉडेलची माहिती

संशोधन दिनांक: 2026-08-12

जाहीर केलेले
पॅरामीटर्स
8B
आर्किटेक्चर
घन
उपलब्धता
मुक्त स्रोत
परवाना
Apache-2.0

सुसंगतता

10.0

एकूण आउटपुट टोकन्स

2,742

एकूण इनपुट टोकन्स

0

इनपुट किंमत

$0.050 / 1M

आउटपुट किंमत

$0.100 / 1M

बरोबर चाचण्या

चुकीच्या चाचण्या: 18

प्रति प्रयत्न पास दर: 10.0%

अस्थिर चाचण्या

0

अस्थिर चाचण्यांत रन्समध्ये मिश्र निकाल असतात (किमान एक पास आणि एक फेल).

प्रतिसाद वेळ (सरासरी)

723ms

प्रतिसाद वेळ (कमाल): 2.17s

प्रतिसाद वेळ (एकूण): 14.45s

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#153 IBM: Granite 4.1 8B

none
खर्च
$0.001
वेळ
3.2s
टोकन्स
491 tok

रन इतिहास

चाचणी तारीख स्कोअर विश्वसनीयता बरोबर चाचण्या एकूण खर्च तुलना करा
2026-08-14 02:51 पुन्हा चाचणी 4.0 10.0 $0.007 तुलना करा
2026-07-16 23:04 नवीन चाचणी जोडली 4.0 10.0 $0.007 तुलना करा
2026-06-04 14:07 नवीन चाचणी जोडली 4.0 10.0 $0.003 तुलना करा
2026-05-22 00:30 सूट बदलला 4.1 10.0 $0.003 सध्याची रन
2026-05-01 00:31 पहिला रन 4.3 10.0 $0.003 तुलना करा

या रनमध्ये वेगळा बेंचमार्क सूट वापरला गेला. ऐतिहासिक बदल वाचताना सूटमधील बदल लक्षात घ्या.

रन तुलना

रनबेंचमार्क कव्हरेजस्कोअरसुसंगतताविश्वसनीयताबरोबर चाचण्याअस्थिर चाचण्याएकूण आउटपुट टोकन्सएकूण इनपुट टोकन्सएकूण खर्चप्रतिसाद वेळ (सरासरी)
2026-05-22 00:30 · सूट बदलला60/60 प्रयत्न4.110.010.02/2002,7420$0.003723ms
2026-08-14 02:51 · पुन्हा चाचणी66/66 प्रयत्न4.010.010.02/2205,996113,836$0.0071.44s
फरक+0.10.00.000-3254-113836-$0.004-720ms

बेंचमार्क कव्हरेज वेगळे आहे: 60/60 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती) विरुद्ध 66/66 प्रयत्न (लक्ष्य: प्रत्येक चाचणीसाठी 3 पुनरावृत्ती). एकूण मूल्ये आणि पुनरावृत्तीवर अवलंबून मेट्रिक्स थेट तुलना करता येत नाहीत.

या दोन रनमध्ये वेगवेगळे बेंचमार्क सूट वापरले गेले, त्यामुळे फरकांमध्ये मॉडेलमधील आणि सूटमधील दोन्ही बदल दिसतात.

चार्ट्स

पहिले मॉडेल निवडा, नंतर दुसरे मॉडेल क्लिक करून बाजू-बाजूची तुलना पेज उघडा.

एकूण आउटपुट टोकन्स

स्कोअर vs एकूण आउटपुट टोकन्स

झटपट तुलना

श्रेणीवार तपशील

श्रेणी स्कोअर सुसंगतता बरोबर चाचण्या
अँटी-एआय युक्त्या 4.9 10.0
कोडिंग 5.2 10.0
संयुक्त 3.0 10.0
डेटा पार्सिंग आणि निष्कर्षण 3.0 10.0
डोमेन-विशिष्ट 3.0 10.0
Samanya Buddhimatta 4.0 10.0
सूचनांचे पालन 3.6 9.9
कोडी सोडवणे 3.2 10.0
टूल कॉलिंग 10.0 10.0
सामान्य ज्ञान 3.0 10.0

तुलना केलेली मॉडेल्स