नेविगेशन
Advertise here

Grok 4.7 (low) vs GLM 5.1 (medium)

GLM 5.1 (medium) average score में आगे है: 7.5 vs 7.4. GLM 5.1 (medium) की benchmark लागत कम है: $1.066 vs $2.263. Grok 4.7 (low) तेज है: 63.19s vs 66.38s, pass rates 73.9% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#127
कुल आउटपुट टोकन
255,329
प्रतिक्रिया समय (औसत)
63.19s
कुल लागत
$2.263
रैंक
#119
कुल आउटपुट टोकन
248,708
प्रतिक्रिया समय (औसत)
66.38s
कुल लागत
$1.066
अनुशंसित मॉडल GLM 5.1 (medium)

It has the best score here (7.5), while costing about 2.1x less than Grok 4.7 (low).

विस्तृत तुलना

मेट्रिक Grok 4.7 Grok 4.7 low रिलीज़: 2026-09-21 GLM 5.1 GLM 5.1 medium रिलीज़: 2026-04-07
स्कोर 7.4 7.5
रैंक #127 #119
विश्वसनीयता 10.0 9.2
संगति 8.3 8.4
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 73.9% 66.7%
अस्थिर टेस्ट 5 4
कुल रन 69 69
प्रति परिणाम लागत 13.804 9.004
कुल लागत $2.263 $1.066
इनपुट कीमत $2.000 / 1M $0.965 / 1M
आउटपुट कीमत $6.000 / 1M $3.032 / 1M
कुल इनपुट टोकन 365,119 331,577
आउटपुट टोकन 8,118 17,919
रीजनिंग टोकन 247,211 230,789
प्रतिक्रिया समय (औसत) 63.19s 66.38s
प्रतिक्रिया समय (अधिकतम) 389.63s 308.75s
प्रतिक्रिया समय (कुल) 1453.28s 1460.31s
पैरामीटर ~1.7T कुल (~170B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#127 SpaceXAI: Grok 4.7

low
लागत
$0.007
समय
15.2s
टोकन
1,537 tok

#119 GLM 5.1

medium
Reached the allocated time limit (300 seconds) without receiving showcase output.
लागत
$0.000
समय
300.0s
टोकन
0 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.7 8.4 7.4 88.9% 1 189.08s 9,579 346 99,053
GLM 5.1 4.6 3.7 44.5% 2 109.63s 5,702 4,871 37,826

त्वरित तुलना

तुलना जोड़ी बदलें