नेविगेशन
AI BENCHY
Advertise here

Grok 4.6 (low) vs GLM 5.3 Flash (high)

Grok 4.6 (low) average score में आगे है: 7.4 vs 7.3. GLM 5.3 Flash (high) की benchmark लागत कम है: $0.029 vs $0.449. Grok 4.6 (low) तेज है: 14.55s vs 25.36s, pass rates 69.7% vs 66.7%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-26

रैंक
#97
कुल आउटपुट टोकन
38,048
प्रतिक्रिया समय (औसत)
14.55s
कुल लागत
$0.449
रैंक
#102
कुल आउटपुट टोकन
78,318
प्रतिक्रिया समय (औसत)
25.36s
कुल लागत
$0.029
अनुशंसित मॉडल GLM 5.3 Flash (high)

Its score stays close to the best score here (7.3 vs 7.4), while costing about 16.0x less than Grok 4.6 (low).

विस्तृत तुलना

मेट्रिक Grok 4.6 Grok 4.6 low रिलीज़: 2026-08-12 GLM 5.3 Flash GLM 5.3 Flash high रिलीज़: 2026-08-26
स्कोर 7.4 7.3
रैंक #97 #102
विश्वसनीयता 10.0 10.0
संगति 9.6 8.9
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 69.7% 66.7%
अस्थिर टेस्ट 1 3
कुल रन 66 66
प्रति परिणाम लागत 2.989 0.216
कुल लागत $0.449 $0.029
इनपुट कीमत $2.000 / 1M $0.075 / 1M
आउटपुट कीमत $6.000 / 1M $0.250 / 1M
कुल इनपुट टोकन 109,960 113,003
आउटपुट टोकन 5,124 11,558
रीजनिंग टोकन 32,924 66,760
प्रतिक्रिया समय (औसत) 14.55s 25.36s
प्रतिक्रिया समय (अधिकतम) 26.46s 163.41s
प्रतिक्रिया समय (कुल) 320.17s 558.01s
पैरामीटर ~1.7T कुल (~170B सक्रिय) 320B कुल (18B सक्रिय)
उपलब्धता बंद स्रोत मुक्त स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#97 SpaceXAI: Grok 4.6

low
लागत
$0.011
समय
26.0s
टोकन
1,941 tok

#102 GLM 5.3 Flash

high
लागत
$0.003
समय
186.7s
टोकन
10,486 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740
GLM 5.3 Flash 8.2 7.2 88.9% 1 19.62s 7,317 373 9,973

त्वरित तुलना

तुलना जोड़ी बदलें