नेविगेशन
Advertise here

Granite 4.2 8B (high) vs Grok 4.20

Granite 4.2 8B (high) average score में आगे है: 4.6 vs 4.1. Grok 4.20 की benchmark लागत कम है: $0.057 vs $0.135. Grok 4.20 तेज है: 1.11s vs 235.89s, pass rates 39.4% vs 27.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-09-18

तुलना किए गए मॉडल

रैंक
#299
कुल आउटपुट टोकन
612,215
प्रतिक्रिया समय (औसत)
235.89s
कुल लागत
$0.135
रैंक
#310
कुल आउटपुट टोकन
1,923
प्रतिक्रिया समय (औसत)
1.11s
कुल लागत
$0.057
अनुशंसित मॉडल Grok 4.20

Its score stays close to the best score here (4.1 vs 4.6), while costing about 2.4x less than Granite 4.2 8B (high).

विस्तृत तुलना

मेट्रिक Granite 4.2 8B Granite 4.2 8B high रिलीज़: 2026-09-02 Grok 4.20 Grok 4.20 none रिलीज़: 2026-03-31
स्कोर 4.6 4.1
रैंक #299 #310
विश्वसनीयता 7.6 लागू नहीं
संगति 6.3 8.1
प्रयास 66/66 54/66
सही परीक्षण
प्रति प्रयास पास दर 39.4% 27.3%
अस्थिर टेस्ट 10 0
कुल रन 66 54
प्रति परिणाम लागत 2.085 1.570
कुल लागत $0.135 $0.057
इनपुट कीमत $0.060 / 1M $1.250 / 1M
आउटपुट कीमत $0.250 / 1M $2.500 / 1M
कुल इनपुट टोकन 43,278 41,313
आउटपुट टोकन 181,083 1,923
रीजनिंग टोकन 431,132 0
प्रतिक्रिया समय (औसत) 235.89s 1.11s
प्रतिक्रिया समय (अधिकतम) 685.87s 6.04s
प्रतिक्रिया समय (कुल) 5189.64s 19.96s
पैरामीटर 8B ~1T कुल (~100B सक्रिय)
उपलब्धता मुक्त स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#299 IBM: Granite 4.2 8B

high
Provider returned error
लागत
$0.000
समय
0.2s
टोकन
0 tok

#310 xAI: Grok 4.20

none
लागत
$0.004
समय
6.5s
टोकन
1,367 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Granite 4.2 8B 3.8 4.3 33.3% 2 515.34s 7,047 42,438 154,749
Grok 4.20 1.1 3.1 0.0% 0 1.22s 1,074 312 0

त्वरित तुलना

तुलना जोड़ी बदलें