नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Grok 4.5 (medium) vs GLM 5.3 (high)

average score लगभग बराबर है: 7.8 vs 7.8. GLM 5.3 (high) की benchmark लागत कम है: $0.610 vs $2.454. GLM 5.3 (high) तेज है: 28.38s vs 68.44s, pass rates 79.7% vs 75.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#104
कुल आउटपुट टोकन
306,044
प्रतिक्रिया समय (औसत)
68.44s
कुल लागत
$2.454
रैंक
#105
कुल आउटपुट टोकन
68,482
प्रतिक्रिया समय (औसत)
28.38s
कुल लागत
$0.610
अनुशंसित मॉडल GLM 5.3 (high)

It has the best score here (7.8), while costing about 4.0x less than Grok 4.5 (medium).

विस्तृत तुलना

मेट्रिक Grok 4.5 Grok 4.5 medium रिलीज़: 2026-07-08 GLM 5.3 GLM 5.3 high रिलीज़: 2026-08-20
स्कोर 7.8 7.8
रैंक #104 #105
विश्वसनीयता 10.0 10.0
संगति 9.0 7.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 79.7% 75.4%
अस्थिर टेस्ट 3 7
कुल रन 69 69
प्रति परिणाम लागत 14.430 4.351
कुल लागत $2.454 $0.610
इनपुट कीमत $2.000 / 1M $1.400 / 1M
आउटपुट कीमत $6.000 / 1M $4.400 / 1M
कुल इनपुट टोकन 308,369 219,811
आउटपुट टोकन 7,013 8,811
रीजनिंग टोकन 299,031 59,671
प्रतिक्रिया समय (औसत) 68.44s 28.38s
प्रतिक्रिया समय (अधिकतम) 436.38s 159.91s
प्रतिक्रिया समय (कुल) 1574.14s 652.78s
पैरामीटर ~1.7T कुल (~170B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#104 SpaceXAI: Grok 4.5

medium
लागत
$0.044
समय
59.4s
टोकन
7,512 tok

#105 GLM 5.3

high
लागत
$0.085
समय
362.5s
टोकन
19,310 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

त्वरित तुलना

तुलना जोड़ी बदलें