नेविगेशन
AI BENCHY
Advertise here

Granite 4.1 8B vs Ling 3.0 Tiny (medium)

Granite 4.1 8B average score में आगे है: 4.0 vs 3.8. Ling 3.0 Tiny (medium) की benchmark लागत कम है: $0.000 vs $0.007. Granite 4.1 8B तेज है: 1.45s vs 68.74s, pass rates 9.1% vs 24.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-07

रैंक
#238
कुल आउटपुट टोकन
5,996
प्रतिक्रिया समय (औसत)
1.45s
कुल लागत
$0.007
रैंक
#244
कुल आउटपुट टोकन
1,021,580
प्रतिक्रिया समय (औसत)
68.74s
कुल लागत
$0.000
अनुशंसित मॉडल Granite 4.1 8B

It has the best score here (4.0), while responding about 47.3x faster than Ling 3.0 Tiny (medium).

विस्तृत तुलना

मेट्रिक Granite 4.1 8B Granite 4.1 8B none रिलीज़: 2026-05-01 Ling 3.0 Tiny Ling 3.0 Tiny medium रिलीज़: 2026-08-07 निःशुल्क उपलब्ध
स्कोर 4.0 3.8
रैंक #238 #244
विश्वसनीयता 10.0 9.7
संगति 10.0 8.9
बेंचमार्क कवरेज 22/22 टेस्ट · 66/66 प्रयास 22/22 टेस्ट · 66/66 प्रयास
सही परीक्षण
प्रति प्रयास पास दर 9.1% 24.2%
अस्थिर टेस्ट 0 3
कुल रन 66 66
प्रति परिणाम लागत 0.315 0.000
कुल लागत $0.007 $0.000
इनपुट कीमत $0.050 / 1M $0.000 / 1M
आउटपुट कीमत $0.100 / 1M $0.000 / 1M
कुल इनपुट टोकन 113,827 104,078
आउटपुट टोकन 5,996 153,908
रीजनिंग टोकन 0 867,672
प्रतिक्रिया समय (औसत) 1.45s 68.74s
प्रतिक्रिया समय (अधिकतम) 16.67s 262.20s
प्रतिक्रिया समय (कुल) 31.96s 1512.22s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#238 IBM: Granite 4.1 8B

none
लागत
$0.001
समय
3.2s
टोकन
491 tok

#244 Ling 3.0 Tiny

medium
अमान्य SVG
लागत
$0.000
समय
177.4s
टोकन
6,873 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.1 8B 4.5 10.0 0.0% 0 775ms 8,344 525 0
Ling 3.0 Tiny 2.9 10.0 0.0% 0 211.99s 7,948 70,838 206,006

त्वरित तुलना

तुलना जोड़ी बदलें