नेविगेशन
Advertise here

Grok 4.7 (high) vs GLM 5.2

average score लगभग बराबर है: 6.7 vs 6.6. GLM 5.2 की benchmark लागत कम है: $0.152 vs $3.582. GLM 5.2 तेज है: 11.27s vs 122.19s, pass rates 72.5% vs 63.8%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#179
कुल आउटपुट टोकन
487,184
प्रतिक्रिया समय (औसत)
122.19s
कुल लागत
$3.582
रैंक
#186
कुल आउटपुट टोकन
17,685
प्रतिक्रिया समय (औसत)
11.27s
कुल लागत
$0.152
अनुशंसित मॉडल GLM 5.2

It has the best score here (6.6), while costing about 23.7x less than Grok 4.7 (high).

विस्तृत तुलना

मेट्रिक Grok 4.7 Grok 4.7 high रिलीज़: 2026-09-21 GLM 5.2 GLM 5.2 none रिलीज़: 2026-06-17
स्कोर 6.7 6.6
रैंक #179 #186
विश्वसनीयता 9.6 10.0
संगति 7.7 9.0
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 72.5% 63.8%
अस्थिर टेस्ट 7 3
कुल रन 69 69
प्रति परिणाम लागत 23.360 1.753
कुल लागत $3.582 $0.152
इनपुट कीमत $2.000 / 1M $0.325 / 1M
आउटपुट कीमत $6.000 / 1M $3.990 / 1M
कुल इनपुट टोकन 329,276 247,919
आउटपुट टोकन 8,172 17,685
रीजनिंग टोकन 479,012 0
प्रतिक्रिया समय (औसत) 122.19s 11.27s
प्रतिक्रिया समय (अधिकतम) 573.57s 79.65s
प्रतिक्रिया समय (कुल) 2810.40s 259.32s
पैरामीटर ~1.7T कुल (~170B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#179 SpaceXAI: Grok 4.7

high
लागत
$0.110
समय
301.3s
टोकन
23,143 tok

#186 GLM 5.2

none
लागत
$0.033
समय
87.7s
टोकन
7,455 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.7 6.0 4.6 66.7% 2 335.92s 10,266 353 199,976
GLM 5.2 3.7 9.5 0.0% 0 7.55s 7,263 1,958 0

त्वरित तुलना

तुलना जोड़ी बदलें