नेविगेशन
AI BENCHY
AD
Track all your projects in one dashboard. Get 📊stats, 🔥heatmaps and 👀recordings in one self-hosted dashboard.
uxwizz.com

Grok 4.6 (low) vs GLM 5.3 (high)

average score लगभग बराबर है: 7.4 vs 7.3. GLM 5.3 (high) की benchmark लागत कम है: $0.403 vs $0.449. Grok 4.6 (low) तेज है: 14.55s vs 27.82s, pass rates 69.7% vs 74.2%.

बेंचमार्क AI BENCHY टेस्ट सूट्स से इस समय जनरेट किए गए:: 2026-08-20

रैंक
#96
कुल आउटपुट टोकन
38,048
प्रतिक्रिया समय (औसत)
14.55s
कुल लागत
$0.449
रैंक
#99
कुल आउटपुट टोकन
63,667
प्रतिक्रिया समय (औसत)
27.82s
कुल लागत
$0.403
अनुशंसित मॉडल Grok 4.6 (low)

It has the best score here (7.4), while responding about 1.9x faster than GLM 5.3 (high).

विस्तृत तुलना

मेट्रिक Grok 4.6 Grok 4.6 low रिलीज़: 2026-08-12 GLM 5.3 GLM 5.3 high रिलीज़: 2026-08-20
स्कोर 7.4 7.3
रैंक #96 #99
विश्वसनीयता 10.0 10.0
संगति 9.6 7.5
प्रयास 66/66 66/66
सही परीक्षण
प्रति प्रयास पास दर 69.7% 74.2%
अस्थिर टेस्ट 1 7
कुल रन 66 66
प्रति परिणाम लागत 2.989 3.099
कुल लागत $0.449 $0.403
इनपुट कीमत $2.000 / 1M $1.400 / 1M
आउटपुट कीमत $6.000 / 1M $4.400 / 1M
कुल इनपुट टोकन 109,960 87,601
आउटपुट टोकन 5,124 6,006
रीजनिंग टोकन 32,924 57,661
प्रतिक्रिया समय (औसत) 14.55s 27.82s
प्रतिक्रिया समय (अधिकतम) 26.46s 159.91s
प्रतिक्रिया समय (कुल) 320.17s 612.06s
पैरामीटर ~1.7T कुल (~170B सक्रिय) 744B कुल (40B सक्रिय)
उपलब्धता बंद स्रोत बंद स्रोत

मॉडल जनरेशन शोकेस

Hamster playing table tennis

Prompt: Create a detailed SVG illustration of a hamster playing table tennis.

#96 SpaceXAI: Grok 4.6

low
लागत
$0.011
समय
26.0s
टोकन
1,941 tok

#99 GLM 5.3

high
लागत
$0.085
समय
362.5s
टोकन
19,310 tok

स्कोर के अनुसार शीर्ष मॉडल

स्कोर बनाम कुल लागत

प्रतिक्रिया समय (औसत)

स्कोर vs प्रतिक्रिया समय (औसत)

कुल आउटपुट टोकन

स्कोर vs कुल आउटपुट टोकन

श्रेणी विवरण

कोडिंग स्कोर संगति प्रति प्रयास पास दर अस्थिर टेस्ट सही परीक्षण प्रतिक्रिया समय (औसत) इनपुट टोकन आउटपुट टोकन रीजनिंग टोकन
Grok 4.6 5.5 7.1 44.4% 1 21.69s 9,579 349 7,740
GLM 5.3 6.6 5.0 66.7% 2 18.89s 7,317 473 8,190

त्वरित तुलना

तुलना जोड़ी बदलें