नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Granite 4.1 8B vs Grok 4.20

Grok 4.20 average score में आगे है: 4.1 vs 4.0. Granite 4.1 8B की benchmark लागत कम है: $0.007 vs $0.057. Grok 4.20 तेज है: 1.11s vs 1.45s, pass rates 9.1% vs 27.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-07-28

रैंक
#224
कुल आउटपुट टोकन
5,996
प्रतिक्रिया समय (औसत)
1.45s
कुल लागत
$0.007
रैंक
#220
कुल आउटपुट टोकन
1,923
प्रतिक्रिया समय (औसत)
1.11s
कुल लागत
$0.057
अनुशंसित मॉडल Grok 4.20

It has the strongest score in this comparison (4.1) and the best overall balance of cost and response time across all 2 models.

विस्तृत तुलना

मेट्रिक Granite 4.1 8B Granite 4.1 8B none रिलीज़: 2026-05-01 Grok 4.20 Grok 4.20 none रिलीज़: 2026-03-31
स्कोर 4.0 4.1
रैंक #224 #220
विश्वसनीयता 10.0 लागू नहीं
संगति 10.0 8.1
सही परीक्षण
प्रति प्रयास पास दर 9.1% 27.3%
अस्थिर टेस्ट 0 0
कुल रन 66 54
प्रति परिणाम लागत 0.315 1.570
कुल लागत $0.007 $0.057
इनपुट कीमत $0.050 / 1M $1.250 / 1M
आउटपुट कीमत $0.100 / 1M $2.500 / 1M
कुल इनपुट टोकन 113,827 41,313
आउटपुट टोकन 5,996 1,923
रीजनिंग टोकन 0 0
प्रतिक्रिया समय (औसत) 1.45s 1.11s
प्रतिक्रिया समय (अधिकतम) 16.67s 6.04s
प्रतिक्रिया समय (कुल) 31.96s 19.96s

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#224 IBM: Granite 4.1 8B

none
लागत
$0.001
समय
3.2s
टोकन
491 tok

#220 xAI: Grok 4.20

none
लागत
$0.004
समय
6.5s
टोकन
1,367 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.1 8B 4.5 10.0 0.0% 0 775ms 8,344 525 0
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

त्वरित तुलना

तुलना जोड़ी बदलें