नेविगेशन
Advertise here

Grok 4.7 (medium) vs GLM 5.3 Flash (high)

average score लगभग बराबर है: 7.3 vs 7.3. GLM 5.3 Flash (high) की benchmark लागत कम है: $0.084 vs $3.501. GLM 5.3 Flash (high) तेज है: 29.11s vs 117.65s, pass rates 78.3% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-10-01

तुलना किए गए मॉडल

रैंक
#134
कुल आउटपुट टोकन
474,745
प्रतिक्रिया समय (औसत)
117.65s
कुल लागत
$3.501
रैंक
#132
कुल आउटपुट टोकन
99,340
प्रतिक्रिया समय (औसत)
29.11s
कुल लागत
$0.084
अनुशंसित मॉडल GLM 5.3 Flash (high)

It has the best score here (7.3), while costing about 42.0x less than Grok 4.7 (medium).

विस्तृत तुलना

मेट्रिक Grok 4.7 Grok 4.7 medium रिलीज़: 2026-09-21 GLM 5.3 Flash GLM 5.3 Flash high रिलीज़: 2026-08-26
स्कोर 7.3 7.3
रैंक #134 #132
विश्वसनीयता 9.8 10.0
संगति 8.3 8.6
प्रयास 69/69 69/69
सही परीक्षण
प्रति प्रयास पास दर 78.3% 66.7%
अस्थिर टेस्ट 5 4
कुल रन 69 69
प्रति परिणाम लागत 19.582 0.426
कुल लागत $3.501 $0.084
इनपुट कीमत $2.000 / 1M $0.150 / 1M
आउटपुट कीमत $6.000 / 1M $0.500 / 1M
कुल इनपुट टोकन 326,066 225,013
आउटपुट टोकन 5,726 12,197
रीजनिंग टोकन 469,019 87,143
प्रतिक्रिया समय (औसत) 117.65s 29.11s
प्रतिक्रिया समय (अधिकतम) 660.89s 163.41s
प्रतिक्रिया समय (कुल) 2706.03s 669.54s
पैरामीटर ~1.7T कुल (~170B सक्रिय) 320B कुल (18B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#134 SpaceXAI: Grok 4.7

medium
लागत
$0.047
समय
132.3s
टोकन
9,954 tok

#132 GLM 5.3 Flash

high
लागत
$0.003
समय
186.7s
टोकन
10,486 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.7 6.6 4.6 77.8% 2 312.17s 10,266 349 172,347
GLM 5.3 Flash 8.2 7.2 88.9% 1 19.62s 7,317 373 9,973

त्वरित तुलना

तुलना जोड़ी बदलें