नेविगेशन
Advertise here

Grok 4.6 (medium) vs GLM 5.3 (high)

average score लगभग बराबर है: 7.8 vs 7.8. GLM 5.3 (high) की benchmark लागत कम है: $0.610 vs $2.270. GLM 5.3 (high) तेज है: 28.38s vs 74.77s, pass rates 78.3% vs 75.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#107
कुल आउटपुट टोकन
266,197
प्रतिक्रिया समय (औसत)
74.77s
कुल लागत
$2.270
रैंक
#105
कुल आउटपुट टोकन
68,482
प्रतिक्रिया समय (औसत)
28.38s
कुल लागत
$0.610
अनुशंसित मॉडल GLM 5.3 (high)

It has the best score here (7.8), while costing about 3.7x less than Grok 4.6 (medium).

विस्तृत तुलना

मेट्रिक Grok 4.6 Grok 4.6 medium रिलीज़: 2026-08-12 GLM 5.3 GLM 5.3 high रिलीज़: 2026-08-20
स्कोर 7.8 7.8
रैंक #107 #105
विश्वसनीयता 10.0 10.0
संगति 8.7 7.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 78.3% 75.4%
अस्थिर टेस्ट 4 7
कुल रन 69 69
प्रति परिणाम लागत 14.187 4.351
कुल लागत $2.270 $0.610
इनपुट कीमत $2.000 / 1M $1.400 / 1M
आउटपुट कीमत $6.000 / 1M $4.400 / 1M
कुल इनपुट टोकन 336,351 219,811
आउटपुट टोकन 6,180 8,811
रीजनिंग टोकन 260,017 59,671
प्रतिक्रिया समय (औसत) 74.77s 28.38s
प्रतिक्रिया समय (अधिकतम) 514.35s 159.91s
प्रतिक्रिया समय (कुल) 1719.73s 652.78s
पैरामीटर ~1.7T कुल (~170B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#107 SpaceXAI: Grok 4.6

medium
लागत
$0.028
समय
72.1s
टोकन
4,771 tok

#105 GLM 5.3

high
लागत
$0.085
समय
362.5s
टोकन
19,310 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.6 8.2 7.2 88.9% 1 120.05s 9,579 351 64,226
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

त्वरित तुलना

तुलना जोड़ी बदलें