नेविगेशन
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Grok 4.5 (low) vs GLM 5.3 (high)

average score लगभग बराबर है: 7.8 vs 7.8. GLM 5.3 (high) की benchmark लागत कम है: $0.610 vs $1.345. Grok 4.5 (low) तेज है: 18.14s vs 28.38s, pass rates 73.9% vs 75.4%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#109
कुल आउटपुट टोकन
121,415
प्रतिक्रिया समय (औसत)
18.14s
कुल लागत
$1.345
रैंक
#105
कुल आउटपुट टोकन
68,482
प्रतिक्रिया समय (औसत)
28.38s
कुल लागत
$0.610
अनुशंसित मॉडल GLM 5.3 (high)

It has the best score here (7.8), while costing about 2.2x less than Grok 4.5 (low).

विस्तृत तुलना

मेट्रिक Grok 4.5 Grok 4.5 low रिलीज़: 2026-07-08 GLM 5.3 GLM 5.3 high रिलीज़: 2026-08-20
स्कोर 7.8 7.8
रैंक #109 #105
विश्वसनीयता 10.0 10.0
संगति 9.3 7.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 73.9% 75.4%
अस्थिर टेस्ट 2 7
कुल रन 69 69
प्रति परिणाम लागत 8.404 4.351
कुल लागत $1.345 $0.610
इनपुट कीमत $2.000 / 1M $1.400 / 1M
आउटपुट कीमत $6.000 / 1M $4.400 / 1M
कुल इनपुट टोकन 308,068 219,811
आउटपुट टोकन 9,218 8,811
रीजनिंग टोकन 112,197 59,671
प्रतिक्रिया समय (औसत) 18.14s 28.38s
प्रतिक्रिया समय (अधिकतम) 205.28s 159.91s
प्रतिक्रिया समय (कुल) 417.21s 652.78s
पैरामीटर ~1.7T कुल (~170B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#109 SpaceXAI: Grok 4.5

low
लागत
$0.011
समय
12.4s
टोकन
2,018 tok

#105 GLM 5.3

high
लागत
$0.085
समय
362.5s
टोकन
19,310 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.5 10.0 10.0 100.0% 0 13.72s 9,579 303 15,641
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

त्वरित तुलना

तुलना जोड़ी बदलें