नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Grok 4.5 (medium) vs GLM 5.2 (medium)

Grok 4.5 (medium) average score में आगे है: 8.5 vs 7.8. GLM 5.2 (medium) की benchmark लागत कम है: $0.224 vs $2.042. GLM 5.2 (medium) तेज है: 23.28s vs 68.59s, pass rates 83.3% vs 80.3%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#37
कुल आउटपुट टोकन
299,460
प्रतिक्रिया समय (औसत)
68.59s
कुल लागत
$2.042
रैंक
#65
कुल आउटपुट टोकन
61,761
प्रतिक्रिया समय (औसत)
23.28s
कुल लागत
$0.224
अनुशंसित मॉडल GLM 5.2 (medium)

Its score stays close to the best score here (7.8 vs 8.5), while costing about 9.1x less than Grok 4.5 (medium).

विस्तृत तुलना

मेट्रिक Grok 4.5 Grok 4.5 medium रिलीज़: 2026-07-08 GLM 5.2 GLM 5.2 medium रिलीज़: 2026-06-17
स्कोर 8.5 7.8
रैंक #37 #65
विश्वसनीयता 10.0 9.5
संगति 8.9 8.0
प्रयास 66/66 63/66
सही परीक्षण
प्रति प्रयास पास दर 83.3% 80.3%
अस्थिर टेस्ट 3 4
कुल रन 66 63
प्रति परिणाम लागत 12.007 2.159
कुल लागत $2.042 $0.224
इनपुट कीमत $2.000 / 1M $0.966 / 1M
आउटपुट कीमत $6.000 / 1M $3.036 / 1M
कुल इनपुट टोकन 122,155 37,199
आउटपुट टोकन 5,514 12,261
रीजनिंग टोकन 293,946 49,500
प्रतिक्रिया समय (औसत) 68.59s 23.28s
प्रतिक्रिया समय (अधिकतम) 436.38s 101.36s
प्रतिक्रिया समय (कुल) 1508.91s 488.94s
पैरामीटर ~1.7T कुल (~170B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#37 SpaceXAI: Grok 4.5

medium
लागत
$0.044
समय
59.4s
टोकन
7,512 tok

#65 GLM 5.2

medium
लागत
$0.041
समय
195.8s
टोकन
9,287 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.5 7.6 7.2 77.8% 1 155.69s 9,579 390 104,634
GLM 5.2 8.2 7.2 88.9% 1 40.96s 7,317 1,475 17,123

त्वरित तुलना

तुलना जोड़ी बदलें

Muse Spark 1.2lowvsGrok 4.5mediumQwen3.8 27BlowvsGLM 5.2mediumGPT-5.2 ChatnonevsGLM 5.2mediumQwen3.8 27BhighvsGrok 4.5mediumKimi K3maxvsGLM 5.2mediumClaude Opus 4.8lowvsGLM 5.2mediumQwen3.7 FlashhighvsGLM 5.2mediumQwen3.8 MaxlowvsGrok 4.5mediumInkling SmallhighvsGrok 4.5mediumGPT-5.6 TerrahighvsGLM 5.2mediumSeed-2.0-CodelowvsGLM 5.2mediumMuse Spark 1.1lowvsGrok 4.5medium