नेविगेशन
Advertise here

Granite 4.1 8B vs Grok 4.20

Grok 4.20 average score में आगे है: 4.1 vs 4.0. Granite 4.1 8B की benchmark लागत कम है: $0.007 vs $0.057. Grok 4.20 तेज है: 1.11s vs 1.44s, pass rates 9.1% vs 27.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-10

तुलना किए गए मॉडल

रैंक
#314
कुल आउटपुट टोकन
5,996
प्रतिक्रिया समय (औसत)
1.44s
कुल लागत
$0.007
रैंक
#309
कुल आउटपुट टोकन
1,923
प्रतिक्रिया समय (औसत)
1.11s
कुल लागत
$0.057
अनुशंसित मॉडल Grok 4.20

It has the strongest score in this comparison (4.1) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Granite 4.1 8B Granite 4.1 8B none रिलीज़: 2026-05-01 Grok 4.20 Grok 4.20 none रिलीज़: 2026-03-31
स्कोर 4.0 4.1
रैंक #314 #309
विश्वसनीयता 10.0 लागू नहीं
संगति 10.0 8.1
प्रयास 66/66 54/66
सही परीक्षण
प्रति प्रयास पास दर 9.1% 27.3%
अस्थिर टेस्ट 0 0
कुल रन 66 54
प्रति परिणाम लागत 0.315 1.570
कुल लागत $0.007 $0.057
इनपुट कीमत $0.050 / 1M $1.250 / 1M
आउटपुट कीमत $0.100 / 1M $2.500 / 1M
कुल इनपुट टोकन 113,836 41,313
आउटपुट टोकन 5,996 1,923
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 1.44s 1.11s
प्रतिक्रिया समय (अधिकतम) 16.67s 6.04s
प्रतिक्रिया समय (कुल) 31.75s 19.96s
पैरामीटर 8B ~1T कुल (~100B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#314 IBM: Granite 4.1 8B

none
लागत
$0.001
समय
3.2s
टोकन
491 tok

#309 xAI: Grok 4.20

none
लागत
$0.004
समय
6.5s
टोकन
1,367 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.1 8B 4.5 10.0 0.0% 0 775ms 8,344 525 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

त्वरित तुलना

तुलना जोड़ी बदलें